AI 日报

VOL.1 · NO.0602026-09-23

澳大利亚及20国呼吁加强AI监管并设立全球监督机构

此举旨在通过国际协作确保AI保持人类控制,但美中两大AI强国未签署,显示出全球治理在监管标准与风险认知上存在严重分歧。

今日主线
  • 前沿模型竞争白热化:Claude 5.5、GPT-6及Grok 4.6密集发布
  • AI Agent商业化落地加速:从工业诊断到科学代码实现高效部署
  • AI法律与伦理风险升级:针对模型安全漏洞的法律诉讼增加
弱信号
  • 决策模型(Decision Models)出现:从生成文本转向输出置信度数值
  • 开源模型训练数据来源引发版权与非法抽取争议
官方动态

xAI 的 Grok 4.6 现已在 Amazon Bedrock 提供

xAI 将前沿模型 Grok 4.6 接入 Amazon Bedrock,该模型专为长时智能体、编码及知识工作设计,支持 500K token 上下文,并提供 mantle 和 runtime 端点支持。

有效第三方评估的优先事项与原则

OpenAI 发布第三方安全评估的优先事项与原则,计划在四个重点领域提供训练、评估和部署的深度访问权限,以独立验证其安全声明与安全论证。

模型与产品
研究前沿

语言模型了解自身的约束吗?

研究发现对Llama 3.1 8B进行SFT和GRPO微调虽将行为合规率提升至约90%,但会降低显式约束报告并侵蚀保留知识,其中基于奖励的信号破坏性最强。

开源与工具

Transformers 现支持 llama.cpp 量化模型

Hugging Face transformers 通过 kernels 库实现了在 Apple Silicon 上运行 GGUF 格式 llama.cpp 量化模型的能力,首批支持 Qwen3.5,用户可通过标准的 from_pretrained API 直接调用。

社区热议

OpenAI 是否解错了问题:Navier-Stokes 方程?

OpenAI 宣称利用 LLM 破解了克雷数学研究所的 Navier-Stokes 问题,但数学家指出其解决的是一个含外力且脱离实际的变体,且该方法无法推广至完整的方程组。

训练 OpenAI AI 的人因用 AI 训练 AI 而被解雇

OpenAI 部分承包商(包括 Mercor 员工)因使用 AI 完成模型审查工作而被解雇。此举引发了业界对模型崩溃的担忧,同时也揭示了 OpenAI 推广 AI 使用与内部监管之间的讽刺矛盾。

一种更快的最短路径算法

AI 智能体设计出名为 C-HD 的确定性最短路径算法,并使用 Lean 语言完成证明。该算法在认证密度范围内性能优于 Dijkstra 算法,而小规模输入则由 Bellman-Ford 算法处理。

Claude Opus 5.5

Hacker News AI 板块出现关于 Claude Opus 5.5 的讨论帖,标志着社区对 Anthropic 该模型版本的关注,但目前尚未提供具体的细节内容。

中文视野

AI编程狂飙,安全跟得上吗?

智谱ZCode因静默上传用户代码引发争议,随后通过致歉、开源以及接受信通院与绿盟科技的安全审计来应对安全质疑。