AAILore Sift

内容

情报流日报主题

工作台

脱水提炼文章与视频

我的

收藏知识库私人设置
AILore Sift事实、判断与机会,保持边界清晰。
AILORE SIFT情报简报
日报周报月报

往期周报

第 40 周202624第 39 周202624第 38 周20269第 37 周202624第 36 周202624第 35 周202620第 34 周202622第 33 周202624第 32 周202624第 31 周202624第 30 周202622第 29 周202624
返回情报流
AILORE SIFTWEEKLY · 2026.W38

AI 周报

2026 年第 38 周

本期重点
9
预计阅读
7 分钟

本周材料呈现两条主线。其一是能力边界的持续外扩:端侧 2B 模型宣称对标 4B 级能力,GPT-6 Astra 同时覆盖自主经营与无人机操控,音乐生成与搜索智能体则以 API、开放权重形式向第三方扩散。其二是治理与安全议题进入前台:OpenAI 与 Anthropic 再发风险警告,Obama 呼吁民主党就 AI 制定明确计划,多家头部公司负责人对独立监督主张公开靠拢,Altman 将 IPO 时间与安全考虑挂钩。落实节奏方面,小米澎程转入全国交付,Deepseek 进入语音对话灰度。

01模型进展302行业动态6
00

PERIOD HIGHLIGHTS

本期看点

  1. 01MiniCPM5-2B:面向端侧的 2B 密集模型发布模型
  2. 02小红书 AllSpark 开源 Search Agent 模型 Iris,两个参数版本评测领先模型
  3. 03硅基流动上线开源模型 Hy4 preview:770B 总参数、1M 上下文模型
  4. 04OpenAI、Anthropic 再发 AI 风险警告;小米澎程今日全国交付;Deepseek 灰度测试 AI 语音对话新闻
  5. 05中国反驳美国 AI 安全警告,称其散布恐惧以锁定美国优势新闻
01

MODEL RADAR

模型进展

3 条

本期模型进展仅一条:MiniCPM5-2B 发布,为 MiniCPM5 系列第二个模型,接续 1B,采用密集 2B Transformer 并沿用同一训练配方放大,面向端侧与资源受限场景。官方称其在同类开源模型中达到 SOTA,整体可与 4B 级模型竞争,并在编码、数学、长上下文与工具调用上优于同尺寸模型,意味着本地部署的能力下限被抬高,端侧选型空间随之变化。

Hugging Face Model Radar65

MiniCPM5-2B:面向端侧的 2B 密集模型发布

Hugging Face 趋势模型列表中出现 MiniCPM5-2B,作者标为未知,任务为 text-generation,热度分 1139,点赞 1344,下载 150110。该模型是 MiniCPM5 系列第二个模型,接续 MiniCPM5-1B,为密集 2B Transformer,沿用同一训练配方放大,面向端侧、本地部署与资源受限场景,官方称在同类开源模型中达到 SOTA,整体可与 4B 级模型竞争。

为什么值得看此前小参数模型通常在编码、数学、长上下文与工具调用上明显落后于更大模型。该模型宣称在保持 2B 规模的同时,于这些能力上优于同尺寸模型,并可对标 4B 级模型,意味着本地部署可用的能力下限被抬高,端侧方案的选型空间发生变化。
AIHOT · X / 公众号精选57

小红书 AllSpark 开源 Search Agent 模型 Iris,两个参数版本评测领先

小红书 AllSpark 团队发布并开源 Search Agent 模型 Iris,同时公开权重与评测代码,35B 与 397B 两个版本在同类评测中成绩领先;团队表示数据与训练配方将陆续公布。

为什么值得看此前搜索类 Agent 的领先方案多为闭源,且公开信息通常只给结果不给权重。此次同时开放权重和评测代码,并覆盖 35B 与 397B 两个量级,使外部团队可复现验证,而不只是看榜单数字。
AIHOT · X / 公众号精选57

硅基流动上线开源模型 Hy4 preview:770B 总参数、1M 上下文

硅基流动宣布开源模型 Hy4 preview 上线其平台。该模型总参数 770B、每 token 激活 49B,支持 1M 上下文,采用 Apache 2.0 协议,面向编码、分析、研究和复杂实际工作。用户可将其接入 Claude Code、Codex、Cursor 等已有工具,图片显示定价为每 1M tokens 输入 $0.834、输出 $2.501、缓存 $0.042。

为什么值得看此前该平台上线的开源模型较少同时具备 770B 级总参数与 1M 上下文,Hy4 preview 把这两项规格与 Apache 2.0 协议、按 token 计费放在一起,使开发者可以在既有工具链中直接调用超大上下文模型,而不必自行部署。
02

INDUSTRY

行业动态

6 条

行业动态以治理与落地并行。OpenAI 与 Anthropic 再发风险警告;Obama 呼吁民主党把 AI 列为核心议程并拿出清晰计划;Altman、Musk、Hassabis 对 Amodei 的独立监督主张表示部分支持,Altman 称 OpenAI 因安全考虑将 IPO 推迟至 2027 年。能力侧,GPT-6 Astra 在经营基准与无人机五子任务上超过人类基线;ElevenLabs 上线 Music v2.5,Iris-mini 与 Iris-pro 以开放权重发布。落地层面,小米澎程全国交付,Deepseek 灰度测试语音对话。

公众号 · 极客公园57

OpenAI、Anthropic 再发 AI 风险警告;小米澎程今日全国交付;Deepseek 灰度测试 AI 语音对话

前一期返回情报流后一期

极客公园「极客早知道」汇总多条动态:OpenAI 与 Anthropic 再次发出「AI 末日」警告;小米澎程于当日起全国交付;Deepseek 正在灰度测试 AI 语音对话。同一摘要还提到 OpenAI 首席执行官表示今年不会上市,以及苹果 iPhone 18 Pro 与 Pro Max 开启全球预购、英伟达相关海报挑战赛开跑。

为什么值得看相较此前同类信息,本次变化在于:一是两家头部 AI 公司再次公开强调 AI 风险,安全议题持续处于行业前台;二是 Deepseek 从文本对话向语音对话扩展并进入灰度,交互形态出现实质推进;三是小米澎程由发布阶段转入全国交付阶段,落地进度可被外部观察。
The Decoder AI News53

中国反驳美国 AI 安全警告,称其散布恐惧以锁定美国优势

中国外交部公开反驳 Anthropic CEO Amodei 等美国 AI 领袖提出的 AI 风险警告,称其为“fearmongering”(散布恐惧);官媒 Global Times 指责 Amodei 发动“silent AI Cold War”。中国安全部门负责人未呼吁放缓 AI 发展,而是要求加快 AI 基础设施建设。特朗普同样反对放缓 AI 发展。

为什么值得看此前 AI 安全警告多由美国企业高管单向发出,此次中国官方与官媒直接点名反驳,并把安全议题重新定义为竞争话语,使 AI 治理从技术讨论转向中美公开博弈。
OpenAI News49

Fyxer 如何打造用户信任的 AI 行政助理

Fyxer 基于 OpenAI 模型构建 AI 行政助理,结合微调、记忆机制和真实用户反馈,跨邮件、会议与日常工作组织信息并起草邮件。其训练数据来自超过 50 万小时的行政助理工作流程,将复杂任务拆解为数十个专用模型来学习用户的上下文、意图和语气。目前 53% 的 AI 邮件草稿被直接采纳无需修改,90 天后超过 90% 的客户仍在付费使用,2025 年年度经常性收入从 100 万美元增长至 3200 万美元。

为什么值得看这组数据把“AI 助理是否可用”从体验描述变成可量化结果:超过一半草稿无需修改、90 天留存超 90%、收入一年内增长数十倍,说明在邮件与日程这类高频场景中,AI 已跨过可用性门槛并形成付费续订。
TechCrunch AI49

Obama 呼吁民主党就 AI 保障措施制定明确计划

TechCrunch AI 报道,Obama 近期表示民主党需要把人工智能列为“核心议程”之一,并就公众担忧的 AI 经济影响与安全问题“拿出非常清晰的计划”。该表态未披露具体政策条款、时间表或立法路径,仅停留在议程与计划层面的公开呼吁。

为什么值得看Obama 作为民主党重量级人物公开把 AI 定位为党的核心议程,意味着该议题可能从技术讨论上升到选举与政策纲领层面。相较此前较分散的监管讨论,这一表态释放出民主党内部可能推动统一方案的信号。
The Decoder AI News48

OpenAI 有数百名合同工在阅读你的 ChatGPT 对话

据 404 Media 报道,OpenAI 雇佣数百名合同工阅读真实的 ChatGPT 对话,并按 1 到 7 分进行评分,部分目的是减少模型的迎合式表达和拟人化行为。这些提示词虽已匿名化,但仍可能包含敏感数据。用户若不希望对话被人工查看,必须主动关闭默认开启的“Improve the model for everyone”设置。

为什么值得看此前公众对 ChatGPT 数据使用的讨论多集中在模型训练,而这次披露的是人工逐条阅读与评分环节,且相关对话即使匿名化仍可能含敏感信息。更关键的是,用户须主动关闭默认开启的设置才能退出,默认同意而非默认拒绝,改变了用户对隐私边界的实际控制方式。
The Decoder AI News47

Sam Altman 呼吁放缓 AI 发展,但表示快速进展仍将持续

Sam Altman 进一步表态支持放缓 AI 开发节奏。据 The Decoder 报道,OpenAI 目前会在重大训练运行前执行安全检查;另据 The Information 消息,OpenAI 已与 Anthropic 和 Google 就联合自我监管进行了数月沟通,但 Altman 同时承诺行业快速进展仍将继续。

为什么值得看此前头部模型公司多在各自框架内披露安全做法,此次出现 OpenAI、Anthropic 与 Google 就联合自我监管进行长期沟通的信息,同时 OpenAI 把安全检查嵌入重大训练流程,意味着竞争关系之外可能出现协调动作,但进展速度并未被承诺放缓。