AAILore Sift

内容

情报流日报主题

工作台

脱水提炼文章与视频

我的

收藏知识库私人设置
AILore Sift事实、判断与机会,保持边界清晰。
AILORE SIFT情报简报
日报周报月报

往期日报

10月2日星期五1610月1日星期四209月30日星期三189月29日星期二139月28日星期一59月27日星期日39月26日星期六149月25日星期五79月24日星期四149月23日星期三129月22日星期二139月21日星期一19月20日星期日89月19日星期六39月18日星期五39月17日星期四39月16日星期三59月15日星期二89月14日星期一69月13日星期日79月12日星期六139月11日星期五109月10日星期四149月9日星期三109月8日星期二139月7日星期一59月6日星期日99月5日星期六109月4日星期五179月3日星期四188月28日星期五148月27日星期四118月26日星期三118月25日星期二108月24日星期一68月23日星期日58月22日星期六178月21日星期五108月20日星期四148月19日星期三108月18日星期二78月17日星期一58月16日星期日78月15日星期六148月14日星期五168月13日星期四148月12日星期三158月11日星期二108月10日星期一78月9日星期日98月8日星期六118月7日星期五98月6日星期四118月5日星期三128月4日星期二178月3日星期一108月2日星期日98月1日星期六97月31日星期五37月30日星期四117月29日星期三147月28日星期二177月27日星期一157月26日星期日87月25日星期六77月24日星期五107月23日星期四107月22日星期三117月21日星期二137月20日星期一107月19日星期日17月18日星期六57月17日星期五127月16日星期四10
返回情报流
AILORE SIFTDAILY · 2026.09.11

AI 日报

2026年9月11日星期五

本期重点
10
预计阅读
7 分钟
01模型进展302产品与商业203行业动态5
00

PERIOD HIGHLIGHTS

本期看点

  1. 01DeepSeek 发布 V4.1-Flash:新架构支持原生视觉理解并降价模型
  2. 02WorkBuddy 上线 DeepSeek V4.1-Flash 并开放两周免费试用模型
  3. 03DeepSeek-V4.1-Flash 上线 SiliconFlow,552B MoE 支持 1M 上下文模型
  4. 04Desert Ant Labs 发布面向语音、文本、视觉的小型专用 AI 模型产品
  5. 05Modeinspect:在代码库中直接设计产品 UI,含 99 天免费 AI 额度产品
01

MODEL RADAR

模型进展

3 条
AIHOT · X / 公众号精选63

DeepSeek 发布 V4.1-Flash:新架构支持原生视觉理解并降价

DeepSeek 发布 V4.1-Flash,采用新的 Causal Encoder-Decoder 架构并支持原生视觉理解。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B,是新架构家族中最小模型。KV cache 需求降至上一代的 HBM 1/4、SSD 1/8,API 价格更低。

为什么值得看这是 DeepSeek 新架构家族的首批模型之一,同时覆盖原生视觉与 MoE 稀疏激活两条路线。KV cache 需求大幅下降并伴随 API 降价,意味着同等显存与存储条件下可承载更长上下文或更高并发,对成本敏感的多模态应用门槛降低。
AIHOT · X / 公众号精选63

WorkBuddy 上线 DeepSeek V4.1-Flash 并开放两周免费试用

WorkBuddy 宣布 DeepSeek V4.1-Flash 已在其平台上线,并提供两周免费试用。该消息引用 DeepSeek 公告称,V4.1-Flash 已登陆 DeepSeek API,并支持原生多模态。证据未披露该模型的具体参数、价格与调用限制。

为什么值得看此前 DeepSeek V4.1-Flash 的可用性仅限于 DeepSeek API 层面,此次由 WorkBuddy 将其接入自有平台,意味着第三方产品已能直接向用户提供该模型能力,并叠加两周免费试用这一获客动作,多模态模型的落地渠道由此扩展。
AIHOT · X / 公众号精选57

DeepSeek-V4.1-Flash 上线 SiliconFlow,552B MoE 支持 1M 上下文

硅基流动宣布,DeepSeek-V4.1-Flash 在其平台 Day 0 上线。该模型为 552B MoE 架构,prefill 阶段约 8B 激活参数、decode 阶段约 16B 激活参数,具备原生视觉能力,上下文窗口达 1M,KV cache 占用约为 V4 Flash 的 1/4,并以 MIT 许可证发布。

为什么值得看相较此前版本,该模型在保持 552B MoE 规模的同时把上下文拉到 1M,并将 KV cache 降至约四分之一,直接缓解长上下文推理的显存与成本压力;MIT 许可证与 Day 0 上线则意味着开发者可更快在第三方平台直接调用。
02

PRODUCT

产品与商业

2 条
Product Hunt41

Desert Ant Labs 发布面向语音、文本、视觉的小型专用 AI 模型

Desert Ant Labs 在 Product Hunt 上发布,定位为提供面向语音、文本和视觉三类任务的小型专用 AI 模型。从公开信息看,它解决的是通用大模型在特定场景下体积大、成本高的问题,转而以更小、更聚焦的模型覆盖单一模态任务。目前尚无更细的模型清单、参数规模或使用方式说明。

为什么值得看此前多数团队要么调用大型通用模型,要么自行训练专用模型,前者成本与延迟偏高,后者门槛高。若小型专用模型能覆盖语音、文本、视觉的基础任务,团队可以按模态拆分选型,而不必为单一功能引入整套大模型,值得在成本和响应速度受限的场景中试用对比。
Product Hunt41

Modeinspect:在代码库中直接设计产品 UI,含 99 天免费 AI 额度

Modeinspect 在 Product Hunt 上线,定位为“在你的代码库中设计产品 UI”,并提供 99 天免费 AI 额度。从现有证据只能确认该产品面向产品界面设计环节,强调与代码库的结合,但具体形态、发布方与收费模式均未披露。

为什么值得看传统流程通常是先在设计工具中出稿、再交由研发在代码库中落地,设计与实现之间存在反复搬运。该产品主张在代码库内完成 UI 设计,若成立,可减少设计稿与代码之间的转换环节,因此值得关注其实际可用性。
03

INDUSTRY

行业动态

5 条
TechCrunch AI64

Anthropic 披露来自 Alibaba、Moonshot AI 与 DeepSeek 的蒸馏活动

Anthropic 于周四发布一份报告,称来自中国的 AI 公司持续对其实施蒸馏攻击,涉及 Alibaba、Moonshot AI 和 DeepSeek。报告指出,随着该领域竞争加剧,这类攻击在近几个月有所升级。目前信息来自 Anthropic 单方面指控,尚无论证细节与第三方核实。

为什么值得看此前模型蒸馏争议多停留在行业猜测层面,此次由头部模型厂商以报告形式点名具体公司,并声称攻击在近几个月升级,意味着模型能力外流问题正从技术争议转向公开指控与合规议题。
The Decoder AI News61

Deepseek 发布 V4.1-Flash,降低 AI 智能体内存需求

Deepseek 发布多模态模型 V4.1-Flash,参数规模 5520 亿,但每 token 仅激活 160 亿参数。相较上一代,KV cache 内存降至四分之一。在 DeepSWE 编程基准上,它以微弱优势超过 Opus 5 和 GPT-5.6 Sol。模型以 MIT 许可证发布,目标指向成本更低的 AI 智能体。

为什么值得看此前大模型部署中 KV cache 内存占用是限制长上下文与多智能体并发的主要成本项之一。V4.1-Flash 将内存需求压缩到上一代四分之一,同时在编程基准上不牺牲性能,意味着同等硬件下可承载更多并发智能体或更长上下文。
The Decoder AI News59

OpenAI 发布 GPT-Live-1 API,支持应用同时说话与聆听

OpenAI 以开发者 API 形式发布 GPT-Live-1 全双工语音模型。该模型在交互性测试中得分 80.1%,其上一代为 45.4%。定价为每分钟 0.05 美元。信源未披露模型架构、支持语言、并发或延迟等技术细节。

为什么值得看相较上一代,交互性测试成绩从 45.4% 提升到 80.1%,说明语音交互从轮流说话向同时听说推进。对开发者而言,这类能力此前难以直接获得,现在可通过 API 调用,但每分钟 0.05 美元的价格会影响其适用场景。
The Decoder AI News54

GPT-6 Astra 登顶 ErdosBench,OpenAI 称数学非优先方向

OpenAI 的 GPT-6 Astra 在 ErdosBench 开放数学问题上取得最高成绩,但首席科学家 Jakub Pachocki 表示数学并非优先级。OpenAI 将资源更多投向递归自我改进与对齐研究。报道认为这表明 AI 发展路径日益“尖峰化”,即在特定领域极强,而非全面进步。

为什么值得看此前业界常以数学能力作为衡量模型推理水平的关键指标,而这次模型在该榜单领先却非公司主攻方向,说明能力增长不再沿统一曲线推进,评估模型强弱需要更细分的领域视角。
The Decoder AI News54

Anthropic 离职研究员 AI 安全警告登上 CNN 与 Fox News

即将离开 Anthropic 的研究员 Jacob Coxon 在 CNN 上警告,可自我改进的 AI 对人类构成生存威胁。报道称 Anthropic 与 OpenAI 的安全研究人员持相似看法,美国政界人士与 Joe Rogan 也关注该话题,相关警告由此进入主流媒体。但文章同时指出,文化与经济利益也在其中起作用,灭绝情景仍是极端且有争议的立场。

为什么值得看此前 AI 安全争论多集中在技术圈与专业论坛,如今通过 CNN、Fox News 等主流电视渠道传播,并牵连政治人物与大众播客,意味着该议题从行业内部讨论转为公共政治话题,可能影响监管讨论与公众认知。
前一期返回情报流后一期