- 类型
- 文章
- 来源
- YouTube · NVIDIA Developer
- 发布
- 2026年9月28日 13:57
- 状态
- 单一信源

发生了什么
NVIDIA Developer 发布技术分享,介绍 H-Company 如何为其计算机使用代理优化 VLM 服务。H-Company 的开源愿景是用透明基础模型扩展自主计算机使用代理,涉及 NVIDIA Holo 和 Holotron 模型家族,并基于 NVIDIA 优化基础设施。该分享讲解这些代理背后的开放架构,并演示如何在 NVIDIA GPU 上使用 NVIDIA Dynamo 部署 Holo 与 Holotron 的代理型工作负载。
为什么重要
此前计算机使用代理的部署多依赖闭源模型和通用推理栈,模型行为与基础设施难以透明控制。该分享把透明基础模型、开放代理架构与专用推理部署工具结合,为代理型 VLM 工作负载提供了可参考的部署路径,可能降低此类代理的落地门槛。
底层逻辑
计算机使用代理需要持续进行视觉语言理解与动作生成,对推理时延和吞吐敏感。NVIDIA Dynamo 面向 GPU 上的代理型工作负载做推理服务优化,H-Company 则将 Holo 与 Holotron 模型家族接入这一栈,使模型、代理架构和基础设施形成配套,从而在保持开放透明的前提下扩展代理规模。
产品与商业机会
对研发团队而言,这意味着部署计算机使用代理时可参考 Holo、Holotron 与 Dynamo 的组合方案,减少自行搭建 VLM 服务与调度逻辑的工作量。产品侧可在 NVIDIA GPU 环境中更快验证代理能力,但具体成本与用户体验收益取决于实际负载和模型表现。
- 评估在现有代理产品中接入 NVIDIA Dynamo 与 Holo/Holotron 组合的可行性,先做小规模推理时延与吞吐测试。
- 围绕计算机使用代理的 VLM 服务,构建可替换的模型适配层,避免绑定单一模型家族或推理后端。
- 针对开放架构代理场景,设计面向企业的私有化部署方案,强调模型透明与基础设施可控。
仍待确认
- H-Company 的具体公司身份和与 NVIDIA 的合作关系尚未在证据中明确。
- Holo 与 Holotron 模型家族的能力边界、许可条款和可用性未说明。
- 该方案相较其他 VLM 服务栈在时延、吞吐或成本上的具体提升幅度未知。
- 计算机使用代理的实际应用场景和商用案例未在证据中披露。