产品介绍
大模型主机 S 是魅视 AI 多模态云边融合的轻量推理款,面向中小型场景与边缘部署。以 2B~9B 大模型本地运行,对小模型初筛结果做多模态语义复审,用可控成本把复杂场景识别准确率从 65% 提升到 85% 以上。
核心优势
轻量大模型
2B~9B 模型本地运行,中小场景也能用上大模型能力,无需中心集群与高额投入。
语义复审降误报
对小模型告警做多模态语义二次过滤,复杂场景误报显著下降、识别准确率提升。
零样本自定义
通过 Prompts 指令库零样本创建算法,无需重训模型即可应对碎片化业务需求。
开箱即用
预装 ubuntu 与主流深度学习框架,标准机架部署,快速完成上线。
硬件参数规格
| 产品型号 | 大模型主机 S |
|---|---|
| 产品定位 | 轻量级推理 / 小型企业 / 边缘部署 |
| CPU | 高性能多核处理器 ×2 |
| GPU 算力配置 | 4× 推理级 GPU 或 2× 高性能 GPU |
| 模型规模 | 2B~9B |
| 大模型并发能力(复审 / 实时) | 复审 ≤256 路 / 实时 ≤128 路 |
| 单请求响应 | ≤3 秒 |
| 网络接口 | 双 10GE 光口 + 千兆管理口 |
| 服务支持 | 原厂 3 年质保 · 7×24 技术支持 |
| 预装软件环境 | Ubuntu + 主流深度学习框架 |
| 部署形态 | 标准 2U 机架式 |
产品定位
- 大模型主机 S
- 轻量级推理 / 小型企业 / 边缘部署
CPU
- 大模型主机 S
- 高性能多核处理器 ×2
GPU 算力配置
- 大模型主机 S
- 4× 推理级 GPU 或 2× 高性能 GPU
模型规模
- 大模型主机 S
- 2B~9B
大模型并发能力(复审 / 实时)
- 大模型主机 S
- 复审 ≤256 路 / 实时 ≤128 路
单请求响应
- 大模型主机 S
- ≤3 秒
网络接口
- 大模型主机 S
- 双 10GE 光口 + 千兆管理口
服务支持
- 大模型主机 S
- 原厂 3 年质保 · 7×24 技术支持
预装软件环境
- 大模型主机 S
- Ubuntu + 主流深度学习框架
部署形态
- 大模型主机 S
- 标准 2U 机架式
注:表中并发路数为建议基准,实际性能视算法复杂度、视频分辨率与点位规模评估;大模型实时检测按每算法 >5 秒一帧设计。