91
该模型是蚂蚁百灵开源的 MoE 模型,总参数达 124B,激活参数仅 5.1B,显著降低推理成本,并提供多种量化版本,体现开源生态在模型效率和部署灵活性上的进展。
AIHOT · X / 公众号精选/
5492
这是 DeepSeek 在开源模型领域的一次重要进展,模型性能进入开源前三,且采用 MIT 许可,降低了使用门槛。对于依赖开源模型的产品团队而言,多了一个高性能、低激活参数的选择,可能影响模型选型和成本结构。
AIHOT · X / 公众号精选/
5493
GPT-6 Astra 作为新模型通过 Microsoft Foundry 上线,意味着大型语言模型经由微软商业渠道正式提供给企业客户。早期客户已在 Azure 使用,说明该模型从预览走向实际部署,改变了企业对前沿模型的可获取性。
AIHOT · X / 公众号精选/
5494
Meta 在五个月内连续推出四个版本,迭代速度极快,且 max 变体评分快速逼近头部模型,表明其在大模型竞争中的实力快速提升,可能改变当前市场格局。
AIHOT · X / 公众号精选/
5495
Muse Spark 在五个月内迭代四次,表明 Meta 正加快模型更新节奏。xhigh 版本在评测中得分 61,为智能体与科学推理任务提供了新的性能参照,可能影响开发者选择模型时的决策。
AIHOT · X / 公众号精选/
5496
这是 Qwen 系列在代码生成领域的一次实质性突破,以更低的价格($5/MToken)实现更高性能,改变了以往高性能模型价格昂贵的局面,可能促使开发者重新评估模型选型策略。
AIHOT · X / 公众号精选/
5497
模型OpenAI推出两款新转录模型API
筛选线索AI 公司模型家族1 个独立信源
此前OpenAI的转录模型(如Whisper)未明确区分实时与批量场景,新模型专攻两种方向,且声称在口音、噪音等复杂条件下有显著准确率提升,这将直接影响语音应用的字准率与用户体验。
AIHOT · X / 公众号精选/
5498
模型GLM-5.3 开放权重,主打智能体编码与网络防御
筛选线索开源模型与生态Agent 智能体模型雷达1 个独立信源
GLM-5.3 开放权重,意味着开发者可自主下载、运行和定制,无需依赖厂商 API。此前多数大模型权重不公开,开放可为智能体编码和网络安全应用提供自主部署基础。
AIHOT · X / 公众号精选/
5399
Hy4 preview在上下文长度上达到1M,远超前代模型,可能支持更长文档处理与复杂任务。同时,激活参数与总参数的比值表明其采用MoE架构,或能平衡性能与推理成本。开源及多平台上线策略,可能降低开发者使用门槛,扩大生态影响。
AIHOT · X / 公众号精选/
53100
腾讯混元推出 Hy ASR 3.0 preview,将语音识别与语义理解结合,支持上下文纠错和热词注入,相比传统 ASR 在准确性和场景适应性上有实质提升,尤其在粤语和高噪环境下表现突出,已落地腾讯云和元宝 App。
AIHOT · X / 公众号精选/
53101
该模型以极低价格和国产芯片支撑,在OpenRouter上取得近20%的周token份额并登顶,表明性价比和本地化芯片方案在开放API市场具备竞争力,可能改变开发者对模型选择的偏好。
AIHOT · X / 公众号精选/
52102
V4-Flash在Agent能力上超越V4-Pro-Preview,且原生支持Responses API和Codex适配,降低了开发者集成门槛,可能促使更多Agent类应用采用该模型。
AIHOT · X / 公众号精选/
52103
相比现有系统,该模型提供多一整天的预警时间,且是国家级气象机构首次实时采用 AI 模型,标志着 AI 在灾害预报领域的应用从研究走向实战。
AIHOT · X / 公众号精选/
52104
此前数学自动形式化领域缺乏大规模、已验证的开放数据集,现有模型效果有限。MathForm 提供了 367K+ 已验证示例,显著提升了形式化任务的准确率,可能加速 Lean 4 在数学证明自动化中的应用,降低入门门槛,促进相关研究和工具链发展。
AIHOT · X / 公众号精选/
51105
此前该模型可能仅限部分用户或未集成 Spark,现在 Pro/Ultra 用户可体验更强的多步骤推理,且 Spark 结合 Workspace 工具调用,显著增强个人智能体的实用性与精准度。
AIHOT · X / 公众号精选/
51