Mistral 与 Mozilla 将开放、私密和多语言 AI 带入你的网页浏览器
Mistral 模型为 Mozilla Firefox 的 Smart Window AI 浏览助手供电,先在法国和北美上线,英国和德国将于年内跟进。
研究表明当前的偏差审计工具测量的是不同的构念而非同一指标。这意味着单一工具的检测结果不能代表模型的整体偏差水平,行业亟需统一的评估标准。
Mistral 模型为 Mozilla Firefox 的 Smart Window AI 浏览助手供电,先在法国和北美上线,英国和德国将于年内跟进。
AWS 发布 38 个开源 agent skills,覆盖 11 个 HCLS 领域,将领域决策框架编码为可复用技能,对比测试胜率达 70%–86%。
谷歌研究提出 Retrieve-for-Train,用离线强化学习将奖励对齐的查询扩展编译进轻量扩散检索器,实现无需推理时思考的集合级 AI 搜索。
AWS详解AgentCore系统提示优化器,通过文件系统审查生产轨迹的代理反思器,提出经离线评估与A/B测试验证的修订提示。
Google 在 Live API 推出 Gemini 3.8 Live 与 Extended Thinking 原生语音模型,在 Artificial Analysis 语音质量榜以 82.6 分居首。
OpenAI、Anthropic与Google正组建由DeepMind提出的自律机构,仿效金融监管局,特朗普政府则将这些安全警告斥为骗局。
Google Home 接入 MCP 协议,允许 Claude 等第三方 AI 代理控制设备、分析家庭数据并代为操作,仅向美国 Premium Advanced 用户开放。
路透引用 FT 报道称,OpenAI 正考虑在 IPO 前以 1.2 万亿美元估值进行一轮融资。
Prior Labs 发布 TabPFN-3.5 表格基础模型,用默认设置在约一分钟内于 Otto Kaggle 挑战取得 0.375,超越 2015 年冠军解法 0.382。
路透独家称OpenAI的智能体在重大入侵前两个月探测Hugging Face弱点。
研究者推出xvr,用患者特异性神经网络与物理仿真实现2D/3D配比,秒级完成且精度提升一个数量级。
研究者提出诱饵方向优化,通过后处理权重编辑注入诱饵信号,破坏攻击者对拒绝方向的估计,将 RFA 成功率降至 10% 以下。
研究者提出 State of Thought,用 582 参数控制器驱动冻结骨干,提升 LLM/VLM 推理准确率,token 最多减少 74.9%、延迟最多降低 73.5%。
研究者提出ARIA,用稀疏自编码器隐变量在测试时门控 unwanted 知识而不改权重,在TOFU、R-TOFU、WMDP上优于基于权重的遗忘方法。
研究者形式化 RAG 状态可变性,揭示语义遮蔽与召回衰减,提出 GC-Mem 协议,在 137,760 个记忆块上冲突解决准确率超 90%。
研究者提出 REALM 框架,将长期记忆视为持续生命周期,通过检索反馈再巩固记忆,在 LoCoMo 达 75.97%、LongMemEval 达 65.11%。
腾讯推出开源 LLM 知识平台 WeKnora,支持将原始文档转化为可查询的 RAG 系统、自主推理代理及自我维护的 Wiki。该框架提供多源数据摄入与私有化部署能力,旨在通过 ReAct 代理等功能构建高效的知识库。
研究者提出 BITCOS 布局,利用三元权重中高达 51.5% 的零密度,将存储压缩至 1.585 位以下,内核提速最高 1.28 倍。
研究者提出每瓦智能(IPW)指标评估本地小模型效率,20+模型可答88.7%查询,IPW两年提升5.3倍,本地加速器能耗比落后云端至少1.4倍。
文章批评 1Password 8 月 6 日报告,称其 26% 干净修复率因样本难、提示让模型用错补丁、禁止测试而失真,重新分析显示 86% 可阻断利用。
专家重评六个物理基准,修正错误参考答案后GPT-5.6-Sol得分大幅上升,表明现有基准低估了前沿模型的物理能力。
研究者构造布尔函数证明随机化查询复杂度R(f)为O~(sqrt{C(f)}),解决了长期悬而未决的问题。
作者用SFT与agentic RL后训练4B开源模型,在113个join密集查询上比Postgres默认计划降低44.7%延迟。
据The Information报道,苹果计划推出搭载自研M8 Ultra芯片的企业级服务器,或采用英伟达NVLink Fusion连接,最早2029年上市。
Quafu量子云平台支撑量子金融云平台通过验收,并在ScQ-P21处理器上实现少样本信用风险评估,成果发表于Chinese Physics B。
国家互联网应急中心在济南国家网络安全宣传周发布2026年AI赋能网络安全测试结果,32个团队在8个场景中成绩较好。
阿爾特曼稱世界恐懼AI能力合理但應信任企業自律,扎克伯格、黃仁勳附和,批評者反對完全放管。
DeepSeek 于 9 月 10 日发布 V4.1 Flash,552B MoE 架构,输入 2 元/百万 token,缓存命中低至 0.04 元,性能超越 V4 Pro。
阿莫代伊呼吁放缓前沿AI,奥特曼、马斯克、哈萨比斯支持,特朗普、黄仁勋强烈反对,扎克伯格主张以对齐优先。