AI 日报

VOL.1 · NO.0212026-08-15

Qwen3.8-27B开源:支持262K上下文且可家用显卡部署

该模型在降低部署门槛的同时提升了编程与办公性能,且采用Apache 2.0协议免费商用。其新增的推理强度控制功能将使开发者能更灵活地平衡计算成本与输出质量。

今日主线
  • AI编码代理能力进化:从自动化维护到大规模架构重构
  • 模型规模与效率优化:追求更低参数量下的高性能推理与泛化
弱信号
  • 多智能体协作中的潜在冲突与自主破坏行为风险
  • AI在解决数十年未解的纯数学难题中展现出突破性潜力
模型与产品
研究前沿

Alaya-EVOKE:从线性缩放监督到无限世界

Evoke模型通过外部化持久世界状态和重设长时程监督教师,实现了上下文有限且低延迟的开放式视频生成,每1.5秒的片段仅需2.11秒即可生成。

Intern-S2-Preview:科学智能基础模型预览版

Intern-S2-Preview-397B结合多模态预训练、强化学习与增强记忆,在SciTS和Biology-Instructions基准上刷新记录,其内存解码器在不修改主干的情况下提升了生物指令平均分5.4分。

开源与工具
社区热议

计算最优并非集群最优

MOSAIC框架研究表明,稀疏MoE模型虽然在FLOPs损失率上达到最优,但在集群实际运行效率上表现最差,导致成本性能关系反转。

中文视野

DeepSeek发布API调价公告,新价格8月17日生效

DeepSeek宣布V4系列模型API将于8月17日起实施峰谷定价。高峰时段(9:00-12:00、14:00-18:00)价格为空闲时段两倍,其中V4 Pro高峰时段输出百万Tokens最高达27元。