地球AI推出行星预测引擎:自动化全球地理空间建模
谷歌研究推出行星预测引擎(PPE),可在数分钟内自动构建全球地理空间模型。该引擎将CDC健康指标预测精度提升了28%,并在2026年刚果埃博拉疫情热点预测中实现了83.3%的召回率。
此裁决揭示了政府利用安全审查报复AI伦理立场之风险。它将影响未来AI公司与国防部门的合作边界,并为AI企业在面对政府政策压力时提供法律保护。
谷歌研究推出行星预测引擎(PPE),可在数分钟内自动构建全球地理空间模型。该引擎将CDC健康指标预测精度提升了28%,并在2026年刚果埃博拉疫情热点预测中实现了83.3%的召回率。
Salesforce 利用 AWS SageMaker Inference Components 的 SchedulingConfig 参数,实现了 AI 模型在两个可用区(Multi-AZ)的均衡部署,在满足合规要求的同时将成本降低了8倍。
OCaml与rclone维护者报告,AI代理在补丁讨论后数分钟内即可发现自动化漏洞利用,其发现速度已超越传统安全披露流程,导致GitHub CVE分配出现3-4周的延迟。
Nvidia宣布与亚马逊扩大合作,计划在2027-2028年交付200万个GPU(含Blackwell Ultra与Rubin芯片),同时据传正接近以129亿美元收购Hugging Face。
OpenAI首席科学家确认Astra模型(AGI实习生)将于9月按计划推出,并计划在12月内部宣布实现通用人工智能(AGI)。
Azure Databricks正式支持OpenAI GPT-5.6 (Sol/Terra/Luna)、智谱AI GLM 5.3及Moonshot Kimi K3等模型,提供按令牌计费与预配吞吐量两种模式并支持多模态输入。
Sarvam AI联合创始人Vivek Raghavan倡导印度AI主权,推出支持22种印度语言的Sarvam 30B/105B及Vision模型,并完成由Nvidia参投的7500万美元B轮融资。
Meta更新AI眼镜功能,规定若遮挡警示灯将停止录制以减少非自愿录制,但欧盟监管机构仍在调查其隐私风险,德国正考虑禁售该产品。
TreeGraft采用多草稿生成器适应性接枝技术优化LLM投机采样,在10组模型对和6个基准测试中将速度平均提升15.1%,最高提升达26.6%。
CIFQA框架通过确定性智能体与Python工具处理金融计算查询,实现95.54%的高精度回答,性能超越同等条件下的更大规模LLM模型。
研究揭示边缘设备能源预测中的“精度-效率悖论”,指出高精度模型可能因推理能耗与电池老化导致净能量损失增加,并据此提出总拥有成本框架。
研究团队开发出LLM与语音特征混合模型,在二语言口语评估中达到0.818斯皮尔曼相关系数,超越81%的专业评分员,且证实暂停编码不影响流利度得分。
研究评估LLM在学术工作流中的表现,发现长文本窗口虽能增强文献综述的连贯性,但会加剧重复与遗漏问题,仍需人工修正以符合学术标准。
研究通过人类专家与LLM评估器对癌症患者的AI医疗摘要进行评估,旨在识别不准确之处并优化提示设计与安全防护机制。
GLM-5.3 现已开源。该模型通过后训练增强了编码与网络安全能力,在 Terminal-Bench 3.0 和 CyberGym 等基准测试中创下开源模型最佳成绩。
Conduct 推出开源 AI 代理运行时治理系统,支持签名策略与哈希链审计,覆盖 CLI、MCP 及 LLM 调用三大执行面,并提供自托管与托管模式。
美国将意大利数字基建集体 Autistici/Inventati 列入全球恐怖组织名单。专家 Irdi 指出,此举将基础设施服务纳入反恐范畴,可能引发欧美分歧。
斯坦福主导发布 Terminal-Bench-Science 0.1,包含 70 项真实科学任务以评估 AI 代理的科研工作流。测试显示 Claude Opus 5 的得分为 30%。
Talos 推出基于浏览器的 AI 代理,通过内置权限内核强制沙盒执行 shell 命令,并利用工具清单拒绝未声明操作,确保所有动作均被记录。
未沙盒化的 MCP 服务器使 AI 代理获得用户级 root 权限,使其能够在无需 sudo 或提示的情况下读写文件、窃取 SSH/AWS 凭证并执行任意代码。
OpenAI联合Anthropic、谷歌、微软及AWS等百余家企业发布公开信,警告AI驱动的攻击正迅速复杂化,现有安全体系已无法应对,呼吁立即升级防御措施以应对日益严峻的威胁。
腾讯发布7700亿参数的Hy4 preview模型,主打办公场景,上下文长度突破100万且激活参数较Hy3翻倍,该消息带动腾讯股价在8月28日午后上涨超2%。
英伟达拟以129亿美元收购Hugging Face。黄仁勋指出明年AI算力需求将增长100%但供应仅能满足70%,并对未能在早期加大对OpenAI和Anthropic的投资表示遗憾。
Cloudflare利用AI工具将工程规范转化为强制执行的管控系统,已阻断近1.6万次违规代码变更,并将该系统扩展至技术设计与事故报告阶段,构建起完整的反馈闭环。
清华大学方璐团队提出FLARE全存内光计算架构,单片集成7378个光子记忆神经元,实现4GHz短期响应与7.45秒长期记忆,单次运算能耗仅61.87阿焦耳,支持无人系统自主导航。
阿里发布Qwen3.8-Flash,智谱推出GLM-5.3-Flash,两者均采用MoE架构。新模型将推理成本降低九成以上,定价仅为上代旗舰的十分之一,重塑了大模型行业的成本竞争格局。