OpenAI 预览超快模式:GPT-5.6 Sol 速度提升至原先14倍
OpenAI 推出超快模式 Ultrafast,使 GPT-5.6 Sol 的运行速度最高提升至原先的 14 倍。该模式通过 Cerebras 硬件支持,可实现每秒 750 个令牌的输出速度。
DeepSeek与阿里等厂商密集发布超大规模开源模型,显著增强了智能体能力并降低了推理成本。中国开源模型下载占比首次超过美国,标志着全球AI竞争重心向高效能、低成本的开源生态转移。
OpenAI 推出超快模式 Ultrafast,使 GPT-5.6 Sol 的运行速度最高提升至原先的 14 倍。该模式通过 Cerebras 硬件支持,可实现每秒 750 个令牌的输出速度。
亚马逊 Bedrock AgentCore 利用 AI 智能体自动化并购尽职调查流程,将原本需要数周的人工分析缩短至数小时,并提供数据合成、优先级筛选及审计追踪功能。
研究团队利用机器学习和贝叶斯优化设计出微生物-膳食纤维组合(如木糖果聚糖与 Bacteroides uniformis),可预测性增强丁酸等有益代谢,实现对人类粪便微生物群落的可控调控。
谷歌发布Gemini 3.7 Flash,在FrontierCode和DeepSWE基准测试中分别达到43.6%和65.3%,编码能力超越Claude Sonnet 5和GPT-5.6 Terra。该模型定价大幅下调50%,输入与输出令牌价格分别为0.75M和3.75M。
阿里开源Qwen 3.8-2.4T Max规模模型,采用92层MoE(512专家)及混合注意力架构,原生支持26.2万Token上下文,并在后训练阶段重点升级了Agent执行能力。
微软计划于8月中旬将Copilot与Microsoft 365 Copilot合并为单一应用,并退役Podcasts和Deep Research,旨在为今年即将推出的“超级应用”奠定基础。
SpaceXAI推出1.5T参数的Grok 4.6及Grok@Bot,在Terminal-Bench v2.1中得分88.4%,在代码与知识工作代理场景表现领先,定价为2/6美元/百万token。Elon称Grok 4.7已在训练中。
AMD收购Taalas将模型直接“刻入”推理芯片,使Llama 3.1 8B的推理速度突破17,000 TPS。该技术将与AMD Instinct GPU融合,打造系统级解决方案。
阿里开源Qwen3.8-2.4T-A95B模型权重,总参数2.4T,每Token激活95B。该模型原生支持262,144 Token上下文,并可扩展至1,010,000 Token。
Anthropic宣布Claude模型自2026年8月2日起生成的文本将嵌入隐形水印以符合欧盟AI法规,但研究人员对其遏制“AI垃圾”内容的实际效果持怀疑态度。
SHAPER框架通过演化技能和上下文代码框架,实现了无需更新模型权重的嵌入式智能体自适应,支持在保持权重冻结的情况下进行演化。
强化学习控制器在LLM训练中将功率限制违规降低了89.8%,并在7B至72B规模下提升了18.1%的输出和26.2%的能效,适用于单GPU至16-GPU机群。
研究团队利用低参数模型替代昂贵LLM智能体,实现了在笔记本电脑上低成本模拟大规模智能体社会,且验证了误差趋势与理论预测一致。
Codex-5.4和Claude Opus 4.6等前沿AI代理在AutoWorldModel-Bench的64次测试中,有91%成功自主优化了涵盖8种游戏环境的世界模型架构。
研究显示AI检测工具常将符合指南的AI辅助修改误判为学术不端,而经过“Undetectable AI”处理后的文本检测准确率几乎为零(标记率低于4%)。
Hugging Face 发起复现 ICML 2026 论文挑战,结果显示 23% 的论文声明被证伪,仅 266 篇实现完全可复现,另有 242 篇的结论仍存在争议。
开源桌面应用 Modly 利用 GPU 本地 AI 将图片转换为 3D 模型,支持 Windows、Linux 及 Apple Silicon macOS,并提供 CLI 自动化接口。
FluidVoice 是一款开源 macOS 语音输入应用,支持本地 AI 增强以防止云端数据泄露,提供低延迟识别并兼容 Nemotron Speech 3.5 等多种模型。
DeepSeek AI推出开源代理框架DeepSeek Harness (dsh),采用插件化架构。该框架目前处于开发者预览阶段,未来将进行涉及兼容性断裂的更新。
Moonshot AI发布Kimi K3开源模型,拥有2.8万亿参数并支持104万令牌上下文。该模型性能与GPT-5.6 Sol和Claude Fable 5齐平,且首次支持原生图文视频处理。
联合国报告警告AI对自然资源的威胁,预计到2030年其用电量将是6.5亿人口年用电量的三倍,水土占用量则相当于撒哈拉以南非洲13亿人口的基本需求。
一个新的AI智能体服务市场上线,支持智能体之间直接交易服务。该平台采用USDC支付且无手续费,输出结果通过JSON Schema自动验证。
Pixy推出可视化编辑器,允许开发者直接在实时网页上进行编辑,并将修改以结构化代码形式同步给代码智能体,无需使用截图或模拟图。
欧盟AI法规自2026年8月起要求AI生成文本必须可检测,但专家认为水印难以在不影响输出质量的情况下实施,且Google的SynthID等方法存在局限性。
DeepSeek宣布于8月17日起调整API价格,最高涨幅达500%。V4-Flash与Pro模型将实施峰谷时段定价机制,高峰时段的价格将为空闲时段的2倍。
DeepSeek发布V4 Pro-0813正式版,其Agent能力全面超越Opus 4.8,多项指标逼近Fable 5,同时在API调用成本上继续保持低价优势。
DeepSeek-V4-Pro与SpaceXAI的Grok 4.6于8月12日同日发布。Grok 4.6性能追平OpenAI旗舰且单任务成本与Kimi K3持平,中美大模型价差随之收窄。
Anthropic的Claude与数学家合作解决了包括668阶在内的12个悬而未决的哈达玛矩阵阶数,清空了2000阶以下所有未解问题,成为FrontierMath基准测试中第4个被AI解决的开放问题。
DeepSeek和Kimi等中国大模型凭借成本优势、开源生态及场景实用性,在全球调用量榜单中领先,其性价比与实用性获得海外用户普遍认可。
清华大学图书馆等机构在福州联合主办2026学术图书馆未来论坛(WAL),吸引600余名全球代表探讨AI浪潮下的图书馆转型、开放科学及可信数据建设。