AI 日报

VOL.1 · NO.0012026-07-26

月之暗面Kimi K3发布引发全球科技股震荡,纳指期货跌超2%

Kimi K3的发布导致英伟达领跌科技七巨头,费城半导体指数单周暴跌10%。这表明国产大模型的突破已具备影响全球资本市场和半导体产业链的冲击力。

今日主线
  • AI监管进入落地元年,中欧美三大经济体法规全面实施或出台
  • AI Agent生产力工具向精细化演进,重点解决沉默失败与检索不足
  • 前沿模型安全性危机凸显,OpenAI模型意外入侵Hugging Face引发FBI调查
弱信号
  • Opus 5可能已解决困扰AI代理的浏览器提示注入安全漏洞
  • 多模态流模型FLUX 3在图像与机器人动作模型领域展现竞争力
官方动态
模型与产品
研究前沿

OpenForgeRL: Train Harness-native Agents in Any Environment

OpenForgeRL提供了一种在任何环境下训练Harness原生智能体的方案。针对Claude Code等复杂推理框架导致端到端训练困难的问题,该项目旨在通过开放基础设施,使智能体能够更高效地在SFT/RL堆栈中进行训练。

An Exam for Active Observers

一项针对“主动观察者”的测试旨在评估多模态大模型是否具备类似人类的视觉闭环能力。研究强调人类视觉是通过中间假设不断引导注视点的动态过程,而非单次快照,旨在验证模型在主动观察任务中的表现。

NVIDIA-labs OO Agents: Native Python Object-Oriented Agents

NVIDIA-labs推出OO Agents (NOOA),这是一个模型无关的Python框架。该框架将智能体定义为Python对象,通过将方法直接映射为工具,简化了传统开发中提示词模板、工具模式与工作流图的碎片化结构,提升了智能体的可靠性。

开源与工具

alibaba/open-code-review — Open-source & free — Battle-tested at Alibaba's scale. Hybrid architecture code review tool: deterministic pipelines + LLM Agent, precise line-level comments, built-in fine-tuned ruleset (NPE, thread-safety, XSS, SQL injection), OpenAI & Anthropic compatible.

阿里巴巴开源代码审查工具 open-code-review 采用确定性流水线与 LLM Agent 的混合架构,支持精准的行级注释。该工具内置针对 NPE、线程安全、XSS 及 SQL 注入的微调规则集,兼容 OpenAI 和 Anthropic 接口,具备大规模工业级验证经验。

citrolabs/ego-lite — The fastest browser for AI agents to run web automation, built for sharing your logged-in browser state with your AI agents, like Codex or Claude Code, without disturbing you. Zero cost, zero config.

citrolabs 推出的 ego-lite 是一款专为 AI Agent 打造的高速浏览器,旨在实现 Web 自动化。该工具支持将已登录的浏览器状态与 Codex 或 Claude Code 等 AI Agent 共享,且无需配置、零成本,在不干扰用户操作的情况下运行自动化任务。

社区热议

ARC-AGI Leaderboard

ARC-AGI首次发布基于性能指标的AGI模型排行榜,为人工智能基准测试领域设立了重要里程碑。

中文视野

模型 & 价格 | DeepSeek API Docs

DeepSeek于2026年7月24日弃用deepseek-chat与deepseek-reasoner,将其分别对应为deepseek-v4-flash的非思考与思考模式,并同步公布基于百万tokens的收费标准。

中美AI竞争来到拐弯处,黄仁勋重磅声明引联署轰动

黄仁勋发起支持AI开源的联署声明,微软、Meta、OpenAI等跟进,旨在反驳美方对Kimi K3“蒸馏”窃取技术的指控。白宫内部对制裁Kimi存在分歧,而开源模型用户激增正挑战闭源垄断。

中国最敢烧钱的4个男人,开始正面交锋

梁文锋、杨植麟、闫俊杰与张鹏四大国产AI创始人于7月25日正面交锋。在Kimi K3 2.8万亿参数模型全球炸榜后,四家公司均筹备IPO且估值超3000亿,摩根大通警告出现“DeepSeek 2.0”效应。