OpenAI揭露并破坏俄方新型隐蔽影响营销行动
OpenAI 发现并破坏了一项由俄罗斯发起的隐蔽影响行动。该行动利用 ChatGPT 推广虚构的以色列智库 International Burke Institute (IBI),并涉及伪造学术内容及所谓的“主权指数”。
OpenAI通过自研芯片在120B至1T规模模型上实现更低的延迟和更高能效,标志着顶尖AI实验室正通过垂直整合硬件来摆脱对Nvidia的依赖并降低推理成本。
OpenAI 发现并破坏了一项由俄罗斯发起的隐蔽影响行动。该行动利用 ChatGPT 推广虚构的以色列智库 International Burke Institute (IBI),并涉及伪造学术内容及所谓的“主权指数”。
AWS 推出 OpenSearch MCP Apps,将跟踪瀑布流和服务拓扑图等交互式可观测性仪表板直接嵌入 AI 代理对话中,旨在消除用户在验证过程中切换工具的需求。
AWS 推出基于 Amazon Bedrock 大模型的 AI 元数据修正流程,通过实现模式对齐与字段验证,助力企业完成大规模数据的标准化与协调。
Billboard 宣布将在榜单和编辑内容中明确标注 AI 生成的音乐,并与 Luminate 等行业伙伴合作开发 AI 检测系统,以确保音乐内容的透明度。
澳大利亚唱片业协会(ARIA)将于 8 月 31 日起执行全球 IFPI 标准,将纯 AI 生成的曲目排除在榜单之外,但 AI 辅助作品仍符合资格,且将追溯调整不合规记录。
苹果推出搭载 M6(2 纳米)和 M5 Ultra 芯片的 Mac mini 与 Studio,旨在通过 Thunderbolt 5 和 MLX 框架强化本地 AI 推理能力,专为本地 AI 开发设计。
Perplexity 与 Nvidia 合作推出 Portable Computer,这是一款可在 Nvidia DGX Spark 或 RTX GPU 上运行的完全本地化 AI 代理,旨在消除云端代币成本。
Elastic 完成对 Deductive AI 的收购,将其 AI 驱动的生产问题根因分析功能集成至 Elastic Observability,旨在帮助工程团队加速故障排查。
Azure AI Foundry 的 Mistral-medium-3-5 模型出现严重性能问题:输入长度被限制在 600 tokens 左右(远低于 128K-256K 规格),高强度推理时 OOM 失败率达 50%,且推理输出被误导至 reasoning_content。
KVBoost通过分块级别键值缓存重用与偏差引导重计算,将LLM推理的首令牌延迟降低4.49倍(从639.1ms降至142.4ms),且在保持99.1%至99.2%精度的前提下实现高效推理。
生成式AI模型对版权造成破坏,版权持有人若采用CC BY-ND许可以阻止AI滥用,将同时限制人类进行合法的创意改编。
研究人员测试LLM解码西里尔字母等音位密码语言的能力,发现模型在抽象能力方面存在不足,这将影响濒危语言的保护效果。
研究团队以票房定义标准构建好莱坞电影数据集,用于多模态AI分析,在突破版权限制的同时首次建立了稳定的评估基准。
研究团队开发了一套基于语言模型的流程,利用检索增强生成(RAG)与技术文档,实现从自然语言描述到ABB RAPID机器人程序的生成与仿真修正。
研究团队针对低资源罗马乌尔都文(Roman Urdu)的仇恨言论分类挑战,对比分析了参数高效微调与提示工程两种方法的性能。
Hugging Face推出量化感知修复(QAH)技术,旨在修复结构化压缩后的4位量化大模型。该方法在9项基准测试中的7项表现超越了原始的bfloat16精度版本。
IBM发布Granite 4.2系列推理大模型(包含3B、8B及30B版本),采用5阶训练策略与多阶段强化学习,支持512K长上下文及原生工具调用,旨在增强代理式操作能力。
Marin开源框架发布,支持基础模型全流程研究。该框架公开了5000亿+参数LLM训练管线、Delphi缩放套件及失败实验记录,旨在实现基础模型开发的可复现性。
DietrichGebert开发AI插件ponytail,通过“懒开发”逻辑梯引导AI避免过度工程化。该工具在保持安全性的前提下,将代码输出量减少了54%至94%。
Anthropic推出官方管理的Claude Code插件目录,包含内部及第三方高质量插件。该目录设定了严格的安全标准,旨在为用户提供经过审核的插件生态。
Python 的 `str.lower()` 在 StringPrep/IDNA 2003 中使用了 Unicode 17.0.0 而非规范要求的 3.2.0,导致大小写折叠不一致(如 `ᎠᎠ` 编码错误),引发安全漏洞 CVE-2026-17084,现已通过 B.3 异常表修复。
阿里巴巴将于 8 月 26 日发布 Qwen 3.8-Flash-Next 模型,该模型采用 a6B 架构且拥有 1250 亿参数,旨在进一步提升推理速度与运行效率。
研究团队利用强化学习训练 AI 通过可编辑的 JavaScript 代码生成图像,并成功解决了创意任务中主观美学评判的奖励函数设计难题。
路透社推出自主大语言模型「Thomson」,该模型基于其 40 年的专有内容训练,开发成本为 4000 万美元,性能已达到顶尖前沿模型的水平。
Ox Alpha(疑为 GLM-5.x 家族)在 7 个涉华敏感话题上表现出针对性审查,行为分析确认其来源,且该模型拒绝披露自身出处。
美国数据中心 2023 年用水量激增至 170 亿加仑,较 2014 年增长 3 倍,其中 80% 用于发电,主要由 AI 需求推动。
英伟达宣布Groq 3 LPX架构全面量产,其响应速度较竞品提升4倍,旨在为智能体AI时代提供低延迟高效计算。首个云服务商Nebius将于今年晚些时候上线该服务。
莫德纳与默克联合研发的mRNA-4157癌症疫苗联合Keytruda用于高危黑色素瘤患者,Ⅲ期临床试验结果显示,该方案使患者复发或死亡风险降低49%,延续了二期试验成果。
欧盟《人工智能法案》第50条于8月2日生效,促使Anthropic、Google、OpenAI及Meta部署统计文本水印和C2PA元数据。与此同时,开源社区开发反制工具,引发合规与反制的博弈。
腾讯WorkBuddy以2097万月访问量领跑AI办公智能体;阿里将“千问办公”整合为支持桌面、云端及企业协同的Agent产品;字节跳动推出“豆包工作”并整合TRAE与扣子团队。
中国首个《智能体支付应用自律公约》于8月24日发布,要求支付清算协会强制执行KYA(Know Your AI)机制并确保用户明确授权,以防范智能体支付相关的安全风险。
微软发布Agent Lightning v1.0强化学习框架,英伟达实现Groq 3 LPX量产并宣布CUDA支持RISC-V。同时,恶意LLM利用推理引擎漏洞威胁主机安全的问题引起关注。