Anthropic CEO:人工智能反弹‘根本是信任危机’
Anthropic CEO Dario Amodei 否认其警告引发了 AI 反弹,认为该现象本质上是一场信任危机。他主张监管机制应倾向于支持小型竞争者,而非让前沿 AI 公司形成垄断。
GLM-5.3通过后训练Scaling显著增强了复杂任务执行力,尤其是编程和安全能力。其权重的开源将降低高性能大模型的获取门槛,对开源社区产生深远影响。
Anthropic CEO Dario Amodei 否认其警告引发了 AI 反弹,认为该现象本质上是一场信任危机。他主张监管机制应倾向于支持小型竞争者,而非让前沿 AI 公司形成垄断。
Stripe 以超过 70 亿美元收购 AI 网关初创公司 OpenRouter。OpenRouter 为 800 万用户提供访问 400 多个 AI 模型的平台,被业界视为 AI 领域的 Stripe。
阿里千问团队发布 Qwen3.8-Max 旗舰大模型并首次开源权重。该模型拥有 2.4 万亿参数,支持长达 10 天的自主编程、真实工作协作及多模态 Agent,定位为端到端可依赖的复杂任务交付模型。
一名匿名女子(Jane Doe 4)加入针对 xAI 旗下 Grok 的集体诉讼,指控其继父利用该 AI 工具将其 11 岁时的照片生成了 7000 余张色情图像,并导致其自杀身亡。
Anthropic 的生物武器过滤器失效近一年,导致 5 万名筛选不严的外包人员的 1.33 亿次对话请求未被过滤。公司表示目前尚未发现相关滥用证据。
人工智能分析公司推出 Optima 平台,允许用户使用自有数据或场景定制基准测试,以比较模型的质量、成本和速度。早期测试显示该方案可将成本降低 10 倍。
SCU5.0测试版针对对话式AI代理平台进行了安全加固与异步优化,修复了包括4个P0级安全漏洞在内的28个关键问题,将架构健康度从6.8提升至8.9,并消除了所有阻塞级缺陷。
SPIRAL利用稀疏自编码器从BiRNA-BERT中提取可解释的RNA特征,揭示了核苷酸级结构与RNA类型选择性,其中层5特征与二级结构(44.3%)及RNA类型(100%)显著关联。
研究团队推出基于蛋白质语言模型的CrossVOI框架,利用跨注意力机制预测挥发性有机化合物与嗅觉受体的相互作用,并首次系统分析其注意力分布与生物功能的关联性。
开源项目ai-memory为AI编码代理提供长期记忆解决方案,旨在简化不同代理供应商之间的交接工作。该工具基于Git托管的Markdown维基实现,可为Claude Code等编码CLI工具提供持久化上下文支持。
美国发布一项战略旨在防止“镜像生命”的研发,警告此类生物可能导致不可逆的生态破坏,并引发人体免疫系统无法识别的致命感染。
卡爾斯魯厄理工學院(KIT)研究團隊利用普通WiFi路由器通过无线电波成像实现对人员的99%识别率,引发公众对隐私风险的严重警告。
研究团队将LLM仅训练于五年级以下美式课程,结果显示即使通过扩大规模、微调或强化学习,模型能力仍被训练数据的知识范围严格限制。
ProofRun通过密码学方式绑定git提交与未提交变更,在无需AI介入的情况下验证AI编码代理的测试结果声明,确保执行结果真实可靠。
AI实验室正故意牺牲模型的知识广度以提升推理能力,例如Qwen3.5 9B在AIME成绩翻倍但知识准确率仅18%,Gemini 2.5 Pro最高仅53%。
MathCode作为一款终端AI编码助手,能将自然语言数学问题转换为Lean 4定理并尝试形式化证明,支持持久化Lean REPL和可重用定理库。
DeepSeek-V4-Flash/Pro于8月17日起调整价格并发布Harness框架;智谱GLM-5.3通过后训练将编程能力提升50%;阿里云正式开源Qwen3.8系列模型。
DeepSeek与月之暗面估值飙升至5000亿+,Kimi K3开源登顶编程榜,DeepSeek V4-Flash具备100倍成本优势,行业估值逻辑正从用户规模转向Token收入。
阿里云于8月14日发布Qwen3.8-27B,该模型是首个参数规模超过2700亿的AI模型,采用了全新的训练数据,规模仅次于Qwen3.8-2.4T-A95B。
阿里千问Qwen3.8-27B与DeepSeek V4 Pro相继开源,Kimi、智谱等国产模型轮番开源,推动中国模型在调用量及开源下载量方面处于全球领先地位。
Anthropic CEO达里奥·阿莫迪回应“AI独裁”质疑并提出监管方案,预测AI将在5-10年内治愈多数疾病,并分享其父因丙肝去世的个人经历及医疗AI进展。
澎湃新闻分析AI生成“精致脸”引发的恐怖谷效应,指出技术虽能实现逼真但缺乏“神似”,警示短视频创作不应以AI模板替代真实情感与审美判断。