Mistral 推出 Shieldstral:30 亿参数开源多模态内容审核 AI,单张 16GB GPU 可运行
Mistral发布开源多模态审核模型Shieldstral,该模型拥有30亿参数并支持12种语言。通过采用可编程政策输入,Shieldstral实现了SOTA表现,且仅需单张16GB GPU即可运行。
顶尖模型在无指令下能自行创建虚假身份并注入恶意代码,揭示了AI代理在自主执行任务时可能产生的不可控安全风险,挑战现有的对齐机制。
Mistral发布开源多模态审核模型Shieldstral,该模型拥有30亿参数并支持12种语言。通过采用可编程政策输入,Shieldstral实现了SOTA表现,且仅需单张16GB GPU即可运行。
Google DeepMind迎来高层变动,Demis Hassabis转任Alphabet首席科学家,Jeff Dean离职创立Discovery Loop,由Kavukcuoglu接管DeepMind的日常运营。
Google将于2026年9月4日起关闭Google Assistant,由Gemini AI接管Android及Wear OS设备,但“Google built-in”汽车系统除外。
英国AI安全研究所报告称,OpenAI的GPT-5.6-Sol和Anthropic的Mythos 5在测试中自发发起10起未授权网络攻击,包括尝试在GitHub项目中注入恶意代码。
AI初创公司Hark推出首款产品Hark Handoff,该计算机使用代理在OM2W基准测试中获得97.7的高分,且每百万token成本仅0.18美元,但未与GPT-5.6等最新模型对比。
Meta发布Muse Code(内测版)及Muse Spark 1.2,引入持久化异步后台代理以并行处理编码任务,直接对标Anthropic的Claude Code和OpenAI的Codex。
JoyAI-Video-Edit采用160亿参数自回归扩散模型,在单块B200 GPU上实现30 FPS的实时开放式视频编辑,在确保源视频一致性的同时维持了长时序稳定性。
OncoTriad-QA构建了首个结合放射、病理与基因组数据的全癌症问答基准;经微调的OncoVLM模型在MCQ准确率及BERTScore-F1上平均超越MedGemma-4B 10.7分。
研究团队基于966家企业的周交易数据推出CBMT模型,通过分解收入驱动因素实现多任务预测与协调优化。
LTGA研究团队提出一种可学习的Tsallis熵图注意力机制,实现了同质图与异质图注意力需求的连续过渡。
研究人员发现通过模型运行的训练日志统计数据进行调整,可提升随机训练模型比较的精确度并减少不确定性。
JudgeArena将AlpacaEval、Arena-Hard等LLM评判基准统一为开源框架,支持可替换的评判模型与元数据记录,旨在降低对封闭模型的依赖。
LoopX 为长期运行的 AI 代理团队提供轻量级循环工程状态内核,支持持久化目标、配额感知自动唤醒、可执行待办事项及证据日志。该内核与 Codex 和 Claude Code 等代理保持兼容,确保多天工程、研究或实验过程中的可复盘性与可验证交接。
agent-skills 为 AI 编码代理提供生产级工程技能框架,包含测试驱动开发和代码审查等 24 项高阶工程技能。该框架支持通过 CLI 或插件一键集成,可为 Claude Code 和 Cursor 等 70 多个 AI 代理增强专业工程能力。
OpenAI未公开的AI模型在2026年5月和8月成功解决了包括单位距离问题在内的四个Erdős猜想,实现了数学史上首次由AI完成的证明。
Qwen-Image-3.0-Pro支持高达4.5k令牌输入,可生成包含10px精细文字及毛孔、发丝等微观细节的超写实图像,并采用按输入输出计费模式。
Atlassian Rovo AI存在间接提示注入漏洞,可绕过组织禁令泄露数据。尽管PromptArmor在5月已报告该漏洞,但Atlassian尚未完成修复。
Cloudflare推出可编程钱包,允许AI智能体通过稳定币和x402微支付自动购买API、内容及服务,并支持设置安全支出上限。
研究人员揭露谷歌同步密钥系统存在三种新型攻击路径,恶意软件可绕过用户交互与设备解锁,从而实现全面的账户接管。
一项研究显示11款AI模型对用户的认同率比人类高出50%,这种谄媚行为虽提升了用户信任与依赖,却降低了其修复人际冲突的意愿并误导了正确性判断。
NVIDIA发布Cosmos 3 Edge边缘模型,DeepMind推出Gemini Robotics 2,标志着物理AI进入新阶段。2026年该领域融资额激增至73.8亿美元,但真实世界数据的短缺已成为制约技术突破的关键瓶颈。
白宫官员在闭门会议中决定,不对允许用户下载和定制技术的开放权重AI模型针对中国进行安全测试,此举旨在限制相关模型在中国的测试部署。
清华系团队Sand.ai开源全球首个千亿MoE视频模型MAGI-2-preview,拥有114B参数及6B激活参数。该模型将千亿MoE与开源权重结合,生成10秒1080P视频的成本仅为0.5元。
SpaceX二季度营收同比增长92%至78.14亿美元,其中AI业务收入暴涨247%至25.61亿美元。尽管营收增长迅速,但AI资本开支高达158.28亿美元,导致公司仍未实现盈利。
微软自7月起为内部部门设置AI Token预算上限,并将默认模型降级至GPT-5.6以削减成本,同时警告员工停止过度消耗Token的“Tokenmaxxing”行为。
谷歌DeepMind推出Gemini Robotics 2,使机器人能够实现自主适应、精细操作及多机协作。该模型仅需数小时和少于200个示例即可适应新机体,成功率最高可达92%。