AI 日报

VOL.1 · NO.0372026-08-31

Qwen3.8-Flash-Next-NVFP4 支持 4xV100 实现 256K 全量上下文

通过 NVFP4 量化和 50GB RAM 卸载,旧款 V100 GPU 现可处理超长上下文。这降低了部署高性能长文本模型的硬件门槛,延长了旧一代硬件的生命周期。

今日主线
  • 版权法律战升级:索尼与华纳起诉 Anthropic 涉嫌大规模盗用歌词与乐谱
  • AI 情绪转向负面:Glassdoor 数据显示员工(尤其是 Gen Z 女性)信任度骤降
  • 模型可解释性突破:CBLL 技术揭示 LLM 隐藏轴结构并实现精准控制
弱信号
  • 自动化去审查工具 Heretic 降低了模型对齐限制的门槛
  • 工业巨头卡特彼勒将矿业自动化经验转化为 AI 部署实践
模型与产品
研究前沿
开源与工具
社区热议

移动端微型模型推理基准测试

人工智能分析机构在iPhone 17 Pro上对微型AI模型进行基准测试。在8GB内存限制下,评估了模型在16K上下文环境中的智能水平与推理速度。

中文视野