AI 日报

VOL.1 · NO.0542026-09-17

十款前沿模型审计显示偏差检测工具间排名仅为随机水平

研究表明当前的偏差审计工具测量的是不同的构念而非同一指标。这意味着单一工具的检测结果不能代表模型的整体偏差水平,行业亟需统一的评估标准。

今日主线
  • AI 基础设施向端侧与开放协议演进,如 Firefox 集成 Mistral 及 Google Home 接入 MCP
  • 企业级 AI 转向专业化技能增强,AWS 发布 HCLS 领域开源 Agent 技能
  • AI 监管与安全博弈升级,行业自律机构筹建与政府态度出现分歧
弱信号
  • 利用离线强化学习将复杂搜索编译为轻量检索器以绕过推理瓶颈
  • 通过注入诱饵信号进行后处理权重编辑以防御 LLM 拒绝方向攻击
官方动态
模型与产品
研究前沿

State of Thought 实现内源性推理

研究者提出 State of Thought,用 582 参数控制器驱动冻结骨干,提升 LLM/VLM 推理准确率,token 最多减少 74.9%、延迟最多降低 73.5%。

通过稀疏自编码器实现测试时遗忘

研究者提出ARIA,用稀疏自编码器隐变量在测试时门控 unwanted 知识而不改权重,在TOFU、R-TOFU、WMDP上优于基于权重的遗忘方法。

开源与工具
社区热议

打破三元 LLM 的 1.58-bit 壁垒

研究者提出 BITCOS 布局,利用三元权重中高达 51.5% 的零密度,将存储压缩至 1.585 位以下,内核提速最高 1.28 倍。

每瓦智能:衡量本地 AI 的智能效率

研究者提出每瓦智能(IPW)指标评估本地小模型效率,20+模型可答88.7%查询,IPW两年提升5.3倍,本地加速器能耗比落后云端至少1.4倍。

中文视野