- 类型
- 模型
- 来源
- AIHOT · X / 公众号精选
- 发布
- 2026年7月30日 17:47
- 状态
- 单一信源
01
发生了什么
Thinking Machines 于 2026 年 7 月 30 日发布 Inkling-Small,该模型总参数 276B,激活参数仅 12B,规模约为原版 Inkling 的四分之一,但性能与原版相当。官方宣布开放完整权重,并已支持在 Tinker 平台进行微调及通过 Tinker Playground 进行文本、图像和音频交互。
02
为什么重要
Inkling-Small 以四分之一的总参数规模实现与原版相当的性能,且仅需 12B 激活参数,意味着在保持性能的同时大幅降低了资源消耗。这标志着高效模型在保持能力上取得进展,可能推动大模型在更广泛场景的部署。
03
底层逻辑
模型通过稀疏激活或混合专家等技术,在总参数(276B)与激活参数(12B)间实现巨大差异,使得推理时无需加载全部参数,从而显著降低计算和内存需求,同时保持性能。开放权重和微调支持进一步降低使用门槛,鼓励社区在此基础上进行定制和优化。
04
产品与商业机会
对产品研发而言,Inkling-Small 提供了高性能、低成本的模型选择,可减少推理成本和时间,提升响应速度。开放权重和微调支持使团队能基于自身数据定制模型,缩短定制化周期。Tinker 集成使原型验证和集成更加便捷,加速产品迭代。
- 基于 Inkling-Small 构建多模态交互应用,利用其低激活参数特性,在边缘设备或资源受限环境中部署。
- 利用开放权重,针对特定垂直领域(如医疗、金融)进行微调,打造专属 AI 助手或分析工具。
- 在 Tinker 平台上快速搭建演示原型,验证产品概念,并借助微调能力持续优化用户反馈。
- 评估将现有基于原版 Inkling 的服务迁移至 Inkling-Small,以降低运营成本并提高吞吐量。
05
仍待确认
- Inkling-Small 的具体架构设计未在证据中说明,是否存在其他细节影响其实际性能。
- 原版 Inkling 的参数量和性能基准未提及,无法量化比较性能持平的准确程度。
- 开放权重的许可证条款和商业使用限制尚不明确。
- Tinker 平台对 Inkling-Small 的支持范围和稳定性有待验证。