AI 日报

VOL.1 · NO.0492026-09-12

DeepSeek发布V4.1 Flash:552B MoE架构实现原生多模态且性能超越V4 Pro

新架构在提升性能的同时降低了KV Cache成本,使高性能多模态能力更普惠。这标志着国产大模型在架构创新与推理效率上取得新突破。

今日主线
  • AI安全威胁升级:Anthropic报告显示模型被用于生物武器、导弹制导及国家级间谍活动
  • 云端推理优化:AWS通过模型缓存和多模态检索提升SageMaker与Bedrock的部署效率
  • AI与学术伦理冲突:数学家抗议OpenAI干扰研究文化,法律界出现AI虚构证词危机
弱信号
  • 推理模型在真实攻击中可能因‘认为环境是模拟的’而失效
  • 纯自然语言证明搜索在国际数学奥林匹克(IMO)级别任务中取得进展
官方动态
模型与产品

Anthropic 阻止利用 AI 制造生物武器的可能企图

Anthropic 威胁情报报告显示,该公司成功阻止了利用 Claude 模型开发生物武器的企图,并发现了由国家关联行为体发起的网络攻击、监控及常规武器滥用行为。

OpenAI 与数学家的争端正在持续升级

25位菲尔兹奖数学家发表公开信,指控 OpenAI 施压更改署名并竞速证明,警告 AI 生成的方案正威胁开放的研究文化。

研究前沿

IMO金牌的开放配方:训练 Nemotron 用于奥林匹克数学

Nemotron 3 Ultra 通过 SFT 与 RL 训练,利用纯自然语言证明搜索在 IMO 2026 中获得 30/42 分。研究团队已开放模型检查点、训练数据、代码以及包含 200 道题目的 Nemotron-IMO-Bench 基准测试。

社区热议

AlphaGenome 绘制 90 亿个 DNA 变异

谷歌 DeepMind 发布 AlphaGenome Atlas,公开预计算覆盖人类参考基因组全部 90 亿个单碱基变异的预测结果,并提供简化界面与影响评分。

中文视野