The Decoder AI News59
OpenAI 以公开测试版形式发布 Agents API,开发者可借此构建云端 agent,使其自主运行数小时、执行代码,并把任务移交给子 agent。除 token 用量外不收取额外费用,Cloudflare、Vercel 和 Oracle 提供额外的沙箱环境。该 API 被视为 Codex 与 ChatGPT 背后的基础设施对外开放。
为什么值得看此前 Codex 与 ChatGPT 的 agent 能力属于 OpenAI 内部能力,开发者难以直接调用;如今以公开测试版开放,并支持长时间自主运行、代码执行与子 agent 任务交接,意味着这类基础设施从产品内置能力变为可被第三方集成的外部服务。
The Decoder AI News51
Anthropic 发布威胁情报报告,记录八个月内 Claude 被滥用的情形。报告称,攻击者用 Claude 编写导弹软件、自主自杀式无人机与全国性监控系统。同时,阿里巴巴 Qwen 团队、DeepSeek 与 Moonshot AI 等中国 AI 实验室被指批量转发请求或提取训练数据,其中 Qwen 相关交互超过 1.51 亿次。
为什么值得看此前对前沿模型滥用的讨论多停留在假设或个案,这份报告把滥用类型具体化到武器软件、无人机蜂群与大规模监控,并把训练数据提取量化为可计数交互,使模型滥用的规模与形态首次以官方情报形式被并置呈现。
TechCrunch AI50
TechCrunch AI 报道,Kimi 的开发商 Moonshot AI 将年度收入目标定为 20 亿美元。报道同时引用 OpenRouter 数据称,K3 模型在该系统上目前每天生成的 token 数量最高可达 3000 亿,但 K3 的使用量在近几个月略有下滑。
为什么值得看此前外界对 Moonshot AI 的关注多集中在模型能力与用户规模,此次明确给出 20 亿美元年收入目标,把讨论从技术指标转向商业化兑现能力;同时 K3 使用量小幅回落与高 token 生成量并存,说明规模与增长并非同向变化。
The Decoder AI News48
The Decoder 报道称,一项集体诉讼指控 Anthropic 在 Claude 订阅服务上存在虚假陈述,具体指向其宣传中使用的用量倍数,认为这误导了订阅者对其实际可用额度的预期。报道未披露原告身份、诉讼法院、索赔金额或 Anthropic 的回应,目前该指控尚属单方主张。
为什么值得看此前外界对 AI 订阅的讨论多集中在模型能力和价格,这次争议首次把用量倍数的宣传口径推到法律层面。若指控被受理并推进,AI 订阅套餐中模糊的额度描述可能成为合规审查对象,而非仅靠社区抱怨来约束。
The Decoder AI News46
据 The Decoder 报道,多名知情人士称 OpenAI 希望从美国国会议员处了解,若整个行业放缓 AI 开发速度,这种做法在法律上是否可行。报道未说明 OpenAI 是否已提交正式提案、征询对象具体是谁,也未给出议员方面的回应。
为什么值得看此前行业竞争的主线是加速迭代与抢先发布,而由头部实验室主动向立法机构询问“集体减速”的合法性,把竞争节奏问题转为合规与协调问题,意味着监管议程可能从单家公司的安全评估扩展到行业整体节奏的设定。