NVIDIA Groq 3 LPX 正式量产,扩展 Vera Rubin 推理支持多智能体系统
NVIDIA Groq 3 LPX 正式量产,与 Vera Rubin NVL72 结合可为 100K 长上下文智能体 AI 提供每秒 3400 令牌的性能,速度是竞品的 4 倍,目前已被 Nebius、CoreWeave 和 SpaceXAI 采用。
此次融资由阿里、腾讯等巨头支持,将加速中国人形机器人商业化进程。这标志着物理AI的竞争从单一厂商演变为生态资本战,直接影响全球具身智能的部署速度。
NVIDIA Groq 3 LPX 正式量产,与 Vera Rubin NVL72 结合可为 100K 长上下文智能体 AI 提供每秒 3400 令牌的性能,速度是竞品的 4 倍,目前已被 Nebius、CoreWeave 和 SpaceXAI 采用。
Nvidia 正在就 300 亿美元以上的估值与 Perplexity 洽谈投资。Perplexity 的年收入在 AI 代理工具的驱动下增长三倍,已超过 7.5 亿美元。
NVIDIA Vera Rubin NVL72 在智能体 AI 工作负载上的每兆瓦吞吐量提升 30 倍,将每百万 token 的成本降至 GB300 NVL72 的 35%,为大规模部署设定了新效率标准。
阿里发布全面开源的通义千问 Qwen3 系列,采用混合推理架构并支持 119 种语言。旗舰模型 Qwen3-235B-A22B 在 MMLU 等测试中表现领先,预训练数据规模达 36 万亿 token。
Anthropic 7 月营收达 650 亿美元,但最新模型 Opus 5 的用户增长不及 Opus 4.8,且 Fable 5 表现低迷,市场趋势显示低成本工具更具竞争力。
台湾检方起诉一名 Nvidia 高管及 Supermicro 员工伪造文件,涉嫌将 130 台受限 AI 服务器(其中 74 台已出口)非法运往中国。
研究团队提出近似同态度量,旨在分析转换器结构在扰动下的稳定性,并将该理论与神经网络潜在表示中的预测状态结构实验结果相结合。
arXiv新论文提出一种世界模型分类方法,将模型分为环境通道、智能体通道以及智能体-环境联合过程三类,以优化系统建模。
LingShu知识图谱以症状为中心,将中医证候与现代生物医学相结合,构建了一个跨学科的疾病-症状-分子关联框架,实现了情境化融合。
ARGUS模型通过心智理论推理与修辞策略,结合策略感知规划与知识锚定,为特定受众生成具有说服力且基于事实的论证内容。
BF1研究团队提出一种确定性的基于块对齐的二元稀疏注意力机制,通过结合局部、全局和对数间隔的历史块,提升长上下文变换器的效率。
研究人员揭示了神经PDE算子存在“错误物理”后门攻击风险,攻击者可触发参数错误但物理外观合理的解,使输出在保持可信性的同时产生错误结果。
AgriciDaniel/claude-obsidian 基于 Karpathy 的 LLM Wiki 模式,利用 Claude Code 将本地源文件转化为 Obsidian 链接式知识图谱。该工具支持 AI 笔记记录与个人知识管理,旨在提供一个用户完全掌控的开源 Notion 替代方案,实现可重复的研究循环。
tashfeenahmed/freellmapi 提供一个 OpenAI 兼容的代理接口,将 34 家 LLM 提供商的免费层(每月约 74 亿 tokens)整合至单一 /v1 端点。该项目支持智能路由、自动故障切换及加密密钥管理,适用于个人实验场景。
OpenClaw 是一款由非盈利 OpenClaw 基金会开发的开源本地 AI 助手。该工具支持跨平台部署,通过基于 Node.js 的 Gateway 运行,可集成多种消息通道、工具及伴生应用。
FDA批准PrecivityAD2血液检测,该检测采用高分辨质谱法检测阿尔茨海默病淀粉样斑块,准确率超过90%,可作为脑脊液检测的替代方案。
2026年AI芯片架构(包括GPU、TPU、LPU等)主导AI计算,NVIDIA保持领先地位,但矩阵乘法任务在内存瓶颈方面仍面临挑战。
LLM生成的自动化申诉正冲击政府服务系统,一项涵盖11个司法管辖区、84起案例的研究显示,复杂且财务吸引力强的领域面临严重的‘洪峰’压力。
GlassBox实时演示浏览器指纹技术,揭示网站如何利用IP、Canvas、音频指纹等硬件、引擎及构建层级信息跟踪用户并实现跨浏览器识别。
生成式AI工具可能导致编程专业能力崩溃,JetBrains研究指出过度依赖此类工具会让初学者产生‘能力错觉’,而非真正掌握编程知识。
LLM(如Qwen3 Coder)可能利用推理引擎漏洞(如vLLM的CVE-2025-9141)在主机上执行任意代码,从而威胁数据中心安全。
智谱AI发布GLM-5.2模型,支持100万Token上下文及国产算力Day 0适配,并采用MIT开源协议。与此同时,其港股市值突破1万亿港元,成为首个进入“万亿俱乐部”的国产大模型企业,标志着中国AI产业从技术追赶转向价值创造。
国产大模型在综合、代码及智能体榜单取得多点突破。智谱glm-5.3-max首次入榜第13位,月之暗面kimi-k3-max升至第10位,而阿里Qwen3.8-max出现下滑,显示出国内AI竞争格局的进一步演变。
小米发布玄戒O3旗舰SoC,采用首创的10核全大核CPU设计(6超大核+4大核),安兔兔跑分达5220万分。该芯片集成200TOPS NPU算力并支持LPDDR6,旨在全面重构AI架构。
中诚华隆发布HL200推理芯片及超节点集群,单卡FP16算力达0.5P,FP4算力达4P。该体系化突破支持万卡级AI推理规模化部署,并实现了全链路SLO优化。
IT桔子对1155位具身智能创业者的分析显示,清华背景、大厂经历及海归博士等标签使融资中位数放大7-10倍。2026年该领域融资规模暴增至934.74亿元,呈现出强烈的“出身”导向。
阿里千问Qwen3.8-27B开源两日下载量破百万。Qwen、KimiK3及DeepSeekV4正引领“义利并举”的开源新模式,通过开源扩大用户基数,实现产业增长与薄利多销。