AI 周报
2026 年第 35 周
- 本期重点
- 20
- 预计阅读
- 13 分钟
本周周报涵盖行业动态、产品与论文研究。行业方面,灰色市场低价售卖Claude令牌,凸显Anthropic安全与定价漏洞。产品动态虽有涉及,但关键进展未详述。论文研究聚焦可信RAG、街道质量评估、放射学AI、5G诊断、智能路由及分布式推理,展示AI在安全、城市规划、医疗、电信、资源优化及边缘计算的前沿探索。
PERIOD HIGHLIGHTS
本期看点
MODEL RADAR
模型进展
GLM-5.3-Flash发布:原生多模态、低成本高效推理
智谱发布GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型,总参数320B,激活参数仅18B。在基准和实际任务中优于GLM-5.2,价格为其十分之一,编码和智能体基准接近Claude Opus 4.8。采用稀疏与线性注意力混合架构和mHC连接,基于30T token多模态语料训练。
Qwen3.8-Flash-Next:Qwen4 架构的开放权重实验预览
Hugging Face 上出现新模型 Qwen3.8-Flash-Next,热度分 3886,获赞 3970,下载量 4810。该模型是 Qwen4 架构的实验性预览,采用混合注意力与 QSA(Qwen Sparse Attention),并重新设计了 Gated DeltaNet 与 Gated Attention 的组合。官方版本 Qwen3.8-Flash 将提供更多生产功能,如默认 1M 上下文长度和内置工具。
Ornith-1.5-9B:端到端自我改进的轻量级编程模型
Hugging Face 上出现趋势模型 Ornith-1.5-9B,是 Ornith-1.5 系列最轻量版本,采用稠密架构,支持单 GPU 部署及量化后的移动端运行。该模型通过端到端自我改进,联合优化任务生成、脚手架构建和解决方案生成,在多项编程与推理基准上超越前代 Ornith-1.0-9B 及部分对比模型。
GLM-5.3-Flash 开源:320B 参数、AA 指数 57,定价为 Opus 4.8 的 1/40
智谱开源 GLM-5.3-Flash(320B 总参数,18B 激活),这是 GLM-5 系列首个原生多模态模型。其 AA 综合智能指数为 57 分,与 Claude Opus 4.8 持平。定价为 GLM-5.3 的十分之一,限时折扣下仅为 Opus 4.8 的四十分之一。模型已接入 ZCode 等平台开放 API,采用稀疏注意力与线性注意力混合架构,推理服务运行在国产芯片集群上。
Qwen3.8-Flash 开源,Qwen4 架构预览
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。