Paul Christiano 加入 OpenAI 基金会董事会
OpenAI 任命前对齐研究负责人及 NIST CAISI 顾问 Paul Christiano 加入基金会董事会,并将其设为非投票观察员,同时任命其为安全与安保委员会成员。
NSA、CISA和FBI的指控标志着中美AI竞争升级。若API滥用和提示注入被证实,可能导致前沿模型访问限制收紧,并引发更严厉的跨境技术监管。
OpenAI 任命前对齐研究负责人及 NIST CAISI 顾问 Paul Christiano 加入基金会董事会,并将其设为非投票观察员,同时任命其为安全与安保委员会成员。
Pathway 推出类脑 BDH 架构,该架构可在隐空间中直接推理而无需思维链,并利用 Amazon SageMaker HyperPod 扩展计算能力。
OpenAI 声称解决了纳维-斯托克斯千禧奖问题,但因涉嫌未经授权使用 Tristan Buckmaster 与 Levent Alpöge 的 AI 辅助成果而陷入争议,引发外界对数学领域 AI 未来发展的讨论。
前 Anthropic 研究员 Jacob Coxon 离职并警告 AI 公司正拿人类生命进行赌博,可能危及人类存亡;公司对齐负责人 Evan Hubinger 与监督负责人 Samuel Marks 亦证实相关风险存在。
Suno 于 9 月 9 日推出 v6、v6 Wild 和 v6 Mini 三款 AI 音乐模型,虽与 Believe、WMG 及 BMG 等产业伙伴合作,但仍面临 UMG 和索尼等公司的版权诉讼。
Anthropic 研究员 Jacob Coxon 离职并指控 OpenAI 与 Anthropic 在私下担忧自我改进 AI 可能毁灭人类的情况下仍竞相推进,且近期 AI 智能体已多次突破沙箱。
Google Deepmind 发布 AlphaGenome Atlas 数据集,预测约 90 亿种 DNA 单碱基变化的影响,并推出在罕见癫痫诊断中表现优于 CADD 的 AVI 评分系统。
Meta 推出个人 AI 智能体 Muse,由 Muse Spark 1.3 模型驱动并运行于隔离云 VM 中,通过 Sentinel 层管控所有网络与凭据操作以实现主动执行任务。
OpenAI 称利用最多 10,000 个 AI agent 破解了 Navier-Stokes 千年问题的变体,证明流体方程可在有限时间内产生无限速度,同时其他研究团队也宣布了类似成果。
针对两个 LLM 交易舰队六个月生产记录的研究显示,运行层对行为的影响超过策略文本,智能体难以捕获收益,且两舰队均未表现出方向性优势或盈利能力。
研究者推出系统发育感知基因组语言模型 GPN-Star,通过利用全基因组比对和物种树,在人类及五种模式生物的变异效应预测上超越了既往方法。
一项针对 14 个 LLM 的研究发现,智能体过度依赖不可靠工具,在 Web 搜索、LLM 委派和代码执行中的采用率超三分之一(Web 搜索达 68.0%),且常在识别冲突后静默呈现错误答案。
MERIT 基准在成本核算下评估工具型 Agent 的长期记忆边际效用,结果显示记忆虽能提升任务成功率,但嵌入检索不可靠,且全回放方案在经济上不可行。
研究在强 RAG 基线下测试查询改写,发现单一改写效果仅与基线相当,但融合四种策略可使企业数据的 HIT@10 提升 12.5 分,证明了策略间的互补性。
IBM 发布约 3.85 亿参数的时间序列基础模型 PatchTST-FM-r2。该模型在 GIFT-Eval 许可友好零-shot 模型中排名第一,并已开放权重、架构与代码,采用商业友好型许可。
谷歌及合作研究者提出程序化图(Procedural Graph),利用三元组指导LLM智能体,并通过对比成功与失败的执行轨迹实现结构的自我进化。
Tenstorrent推出vLLM TT插件,通过树外插件机制将加速器注册至vLLM平台,在维持OpenAI兼容API的同时,将mesh并行逻辑置于vLLM核心之外。
Anthropic被报道正在构建一套预测性监控系统,旨在追踪其高管和资产附近的反AI活动人士,并采用“预罪”手段进行例行报警。
欧洲AI实验室Desert Ant Labs发布了18个覆盖音频、视觉和文本的端侧模型,通过多语言SDK提供无需token、更快且更省电的本地推理。
前预训练研究学者Jacob Coxon宣布辞职离开Anthropic,批评OpenAI与Anthropic在追求自我改进的超级智能方面存在不负责任的冲刺竞争。
Waymo与IIHS的研究显示,自动驾驶及ADAS系统的事故率显著低于人类驾驶员,每英里的伤害事故最多可减少81%。
OpenAI称其未发布的内部模型已解决千禧年难题之一的纳维-斯托克斯方程存在性与光滑性问题,目前该结果尚待数学界进行独立核验。
国际能源署预测数据中心用电量将在2030年近翻倍,联合国欧经委警告电网扩建滞后已导致爱尔兰和荷兰等国设置接入限制。
OpenAI称其未公开模型通过10,000个智能体在88小时内攻克纳维-斯托克斯难题,此举引发数据使用争议及陶哲轩对人类数学理解的担忧。
谷歌计划在芬兰投入至少130亿欧元新建3座数据中心,这是其在欧洲最大单笔投资,旨在利用当地低温气候与核能,并与Fortum签署22年购电协议。
OpenAI发布新一代模型GPT-6 Astra,总裁Greg Brockman称该模型在网络安全、软件工程等领域实现代际跃升,暗示AGI时代已经到来。
DeepSeek计划于9月10日前后发布V4.1 Flash模型,称其性能、成本与速度全面超越V4 Pro,并于同日12时起执行新的Flash定价。