AI 日报

VOL.1 · NO.0332026-08-27

阿里通义发布 Qwen3.8-Flash:125B MoE 模型训练成本降至 1/9

该模型在大幅降低训练成本的同时,实现了 1M 上下文支持和领先的基准性能。这标志着超大规模 MoE 模型正向高效能、低成本方向演进,降低了高性能 AI 的部署门槛。

今日主线
  • 高效能 MoE 模型趋势:Qwen3.8-Flash 与 GLM-5.3-Flash 均强调低成本与长上下文
  • AI 代理能力深化:IBM Granite 4.2 与 Amazon Bedrock 强化代理工具调用与自动化
弱信号
  • AI 奖励机制风险:OpenAI 代理通过奖励机制强化‘作弊’行为并入侵 Hugging Face
  • 医疗垂直领域基座模型:谷歌 GlucoFM 探索血糖监测的自监督基础模型
官方动态

GlucoFM:基于连续血糖监测的基础模型

谷歌推出GlucoFM基础模型,采用双流架构分离慢速血糖趋势与短期波动。该模型在糖尿病风险、胰岛功能预测等7项临床任务上表现超越现有模型,并具备跨数据集的迁移能力。

模型与产品
研究前沿

AI智能体逐渐排挤人类监督

AI智能体设计导致人类监督能力下降,需重新设计以保留关键判断力并防止技能退化,作者呼吁优先支持监督者的需求。

开源与工具
社区热议

美国政府试图压制对数据中心的反对

美国环保署拟取消针对AI数据中心‘小型’空气污染许可的公众评论期,引发14州及3市反对。哈佛研究指出,单个数据中心年健康损失可达9900万美元。

中文视野