AAILore Sift

内容

情报流日报主题

工作台

脱水提炼文章与视频

我的

收藏知识库私人设置
AILore Sift事实、判断与机会,保持边界清晰。
2026年10月2日星期五

本期概览

13

约 9 分钟读完

新闻
3
论文
5
产品
2
模型
3
阅读本期日报

今日焦点

Albertsons 如何从内部重塑零售体验

发生了什么
OpenAI News 报道,Albertsons Companies 正在使用 ChatGPT Enterprise 与 OpenAI API,帮助内部团队提升工作速度,同时让数百万消费者的食品杂货购物体验更便利。这一消息来自 OpenAI 官方渠道,发布时间为 2026 年 10 月 1 日,但披露内容停留在合作方式与目标层面,未给出具体门店、业务环节或量化结果。
为什么值得看
此前大型连锁零售商引入生成式 AI 多集中在单点客服或营销试验,而 Albertsons 同时把 ChatGPT Enterprise 用于内部团队协作、把 OpenAI API 用于面向消费者的购物流程,说明零售企业的 AI 部署正从局部试点转向覆盖内部效率与前端体验的组合方式。
新闻评分78类别:新闻来源:OpenAI News阅读全文
全部新闻论文产品模型

情报流

#Story为什么值得看类别评分
16

模型DeepSeek V4闪存版官方发布,智能体能力大幅增强

筛选线索Agent 智能体AI 编码AI 公司模型家族1 个独立信源

这是DeepSeek-V4-Flash从预览走向正式版的实质更新,模型智能体能力(如终端能力、代码生成)相较预览版本有巨大提升,部分基准超越同期Pro版本,但整体仍略逊于Opus-4.8,同时以更小规模达到接近顶级模型的水平。

Hugging Face Model Radar/7月31日 07:30
66
17

模型Solar-Open2-250B模型:250B参数激活15B的百万token上下文开源大模型

筛选线索开源模型与生态Agent 智能体AI 公司大语言模型1 个独立信源

此前主流开源大模型在长上下文场景下推理成本极高或上下文窗口有限。Solar-Open2-250B通过混合注意力和稀疏激活,以接近小模型的推理成本提供大模型能力,同时支持百万token,为代理型应用(如文档分析、代码生成)提供了更实用的开源选择。

Hugging Face Model Radar/7月22日 02:40
66
18

模型Artificial Analysis:Claude Sonnet 5.5、GPT-6.1 Sol 与 Gemini 4 Argon 登顶 Coding Agent Index 但成本差异大

筛选线索Agent 智能体AI 编码模型家族模型雷达1 个独立信源

Coding Agent 的评测开始同时呈现能力分数与每任务成本,而不是只比单一的模型能力。榜首模型虽然得分最高,但成本也最高,说明“最强”与“最划算”可能不是同一个选择,选型维度从分数转向性价比。

AIHOT · X / 公众号精选/10月2日 00:17
66
19

模型Artificial Analysis 评测:Qwen-Image-2.1 在两个 AA-Image 榜单中成为排名第一的开源权重模型

筛选线索图像生成开源模型与生态模型家族模型雷达1 个独立信源

此前开源权重图像模型在两个 AA-Image 榜单上均未达到这一位置,Qwen-Image-2.1 同时超过 Ideogram 4.0(Quality)和 HunyuanImage 3.0 Instruct,说明开源权重方案在文生图与图像编辑两个维度上已进入可对比头部模型的行列,而不再只是低成本的替代选项。

AIHOT · X / 公众号精选/10月1日 22:43
66
20

模型DeepSeek 发布 V4-Pro-0813 正式版,性能大幅提升

筛选线索Agent 智能体AI 编码AI 公司模型家族1 个独立信源

相比预览版,DeepSeek-V4-Pro-0813 在代理能力、基准测试上有显著提升,尤其在终端任务、软件工程等场景,表明 DeepSeek 在 Agent 领域取得进展,对依赖大模型的工具类产品构成竞争压力。

Hugging Face Model Radar/8月13日 03:05
66
21

模型MiMo-V2.6-Pro 与 MiMo-V2.6-Flash 登陆 Agent Arena,分列开源模型第5和第9

筛选线索开源模型与生态Agent 智能体模型雷达1 个独立信源

同一系列从上一代开源第13、净得分为负,变为新一代开源第5且净得分为正,名次提升9位,说明该模型在真实智能体任务上的可用性出现明显跃迁,而非仅参数或基准分数的变化。

AIHOT · X / 公众号精选/10月1日 18:57
66
22

模型Claude Sonnet 5.5 两个配置进入 Code Arena: WebDev 前四

筛选线索模型家族模型雷达1 个独立信源

同一模型的两个推理配置同时进入前四,xHigh 与第 2 名只差 2 分,且 High 配置价格明显更低。相比 Sonnet 5,分数从 1540 提升到 1699,多个子项从第 30 多名跃升至第 4,说明其在 WebDev 细分能力上的位置发生了实质变化。

AIHOT · X / 公众号精选/10月1日 16:51
66
23

模型Qwen 发布开源模型 Qwen3.8-2.4T-A95B

筛选线索开源模型与生态Agent 智能体AI 公司模型家族1 个独立信源

此前 Qwen-Max 级能力仅限闭源 API,本次 Qwen3.8-2.4T-A95B 将同类能力开源,使开发者可自行部署,降低了使用高性能模型的门槛,可能影响行业对开源与闭源模型的性能认知和选型。

Hugging Face Model Radar/8月8日 01:50
66
24

模型通义千问发布 Qwen-Image-2.1:7B 单检查点兼顾图像生成与编辑

筛选线索图像生成大模型与推理AI 公司模型家族1 个独立信源

此前图像生成与编辑通常需要分别部署模型或检查点,Qwen-Image-2.1 将两类能力合并到 7B 单检查点中,并支持最多 10 张参考图,意味着生成与编辑可以在同一模型内完成,模型部署和调用链路可能因此简化。

AIHOT · X / 公众号精选/9月21日 02:50
66
25

模型Artificial Analysis:GPT-6.1 Sol 单任务成本较 GPT-6 Sol 低约 30%

筛选线索模型家族模型雷达1 个独立信源

变化集中在单位任务成本而非能力指标:若同一任务的平均花费持续下降,调用同等预算可完成的任务量上升,模型选型与定价谈判的参照点从单次调用价格转向 Cost per Task。GPT-6 Sol 相对 GPT-5.6 Sol 的差距,进一步说明这一指标在多代之间呈连续下行。

AIHOT · X / 公众号精选/10月1日 00:09
65
26

模型Gemini 4 Argon (High) 在 Arena Agent Arena 位列第 8,净提升 +7.92%

筛选线索Agent 智能体模型家族模型雷达1 个独立信源

这是 Gemini 4 Argon 在 Agent 类评测中的一次公开排名披露,Agent Arena 关注的是多步任务执行能力,与常规对话评测维度不同。净提升 +7.92% 与每任务 0.62 美元同时出现,说明排名提升伴随可量化的单任务成本,为后续比较不同模型在智能体场景下的性价比提供了参考点。

AIHOT · X / 公众号精选/9月30日 21:35
65
27

模型GPT-6.1 Sol (Max) 以 1759 分位列 Code Arena: WebDev 第 3 名

筛选线索AI 公司模型家族1 个独立信源

相较 GPT-6 Sol (Max),新版本在价格不变的情况下分数提升 70 分、排名上升 4 位,且所有类目均有提升,说明同价位段的能力基线被进一步抬高,WebDev 场景的竞争位次随之变化。

AIHOT · X / 公众号精选/9月30日 18:42
65
28

模型蚂蚁百灵发布 Ling-3.1-flash,升级真实世界长任务能力

筛选线索模型雷达1 个独立信源

该模型将上下文上限拉到 1M,同时以约 560B 总参数、约 25B 激活参数控制推理成本,并提高线性 Attention 层比例。这使长任务处理在容量与效率之间有了新的折中方案,值得关注其对长上下文场景的实际可用性。

AIHOT · X / 公众号精选/9月30日 12:30
65
29

模型DeepSeek 开源面向华为昇腾平台的基础设施组件

筛选线索开源模型与生态模型家族模型雷达1 个独立信源

此前 DeepSeek 的开源基础设施组件以英伟达平台为主,此次则把同一套组件体系搬到华为昇腾平台,形成一一对应的双平台布局。这为在昇腾上复现 DeepSeek 的模型训练与推理流程提供了可用的基础组件。

AIHOT · X / 公众号精选/9月30日 02:01
65
30

模型GPT-6.1 上线 Agent Arena 评测平台

筛选线索Agent 智能体AI 公司模型家族1 个独立信源

与此前以静态问答或短任务为主的评测方式相比,这次把模型放进可调用搜索、文件系统与终端的真实长时程任务中,并让用户投票参与评估。评测场景从单轮回答转向多步骤工作流,考核维度更贴近实际使用中的智能体能力。

AIHOT · X / 公众号精选/9月29日 18:46
65
上一页
123…9
下一页