GPT-5.6 Sol 如何协助运行量子计算实验
MIT研究生Beatriz Yankelevich通过Codex连接GPT-5.6 Sol,实现了超导量子比特常规校准测量的自动化运行,但在处理弱信号或噪声干扰时仍需人工指导。
该图谱通过 AI 模型量化了所有单碱基突变的影响,并引入 AVI 评分。这将极大提升识别致病突变的效率,加速精准医疗与遗传病研究。
MIT研究生Beatriz Yankelevich通过Codex连接GPT-5.6 Sol,实现了超导量子比特常规校准测量的自动化运行,但在处理弱信号或噪声干扰时仍需人工指导。
AWS在SageMaker AI上对30B MoE模型进行了基准测试,结果显示G7(NVIDIA Blackwell)实例在吞吐量、延迟及成本方面均优于G5、G6和G6e,且所需GPU数量更少。
HPE Zerto基于Amazon Bedrock构建了本地智能体排障系统,利用自然语言辅助数据保护与灾难恢复团队评估基础设施健康状况、调查故障并指导恢复决策。
滴滴国际业务部基于Amazon Bedrock打造了覆盖西语和葡语的客服中心质检系统,将意图验证准确率从38%提升至86%,合规评分超过90%。
一项针对1129只眼睛的研究表明,TabPFN机器学习可基于Eyerobo筛查仪预测睫状肌麻痹验光,结合IOL Master生物测量后,其精度足以作为儿科分诊辅助工具。
OpenAI出资500万美元资助独立研究,旨在探讨生成式AI对13至17岁青少年生活与发育的影响,重点关注社交与情感结果。
Mistral完成30亿欧元D轮融资,估值突破210亿欧元,创欧洲科技公司融资规模纪录。该公司计划利用资金扩展算力,在减少对美国依赖的背景下推进主权AI战略。
数学家Buckmaster指控OpenAI研究员Bubeck施压要求其移除Anthropic的Alpöge在Navier-Stokes证明论文中的合著者身份。OpenAI对此予以否认,称未见过相关工作且其解决方案不同。
Meta推出个人AI智能体Muse,旨在处理日常任务。该产品是Meta数百亿美元AI战略转型的核心,旨在追赶OpenAI和Google等竞争对手。
科技透明项目发现Meta今年漏检332条AI生成的儿童色情广告,其中多数推广将真实儿童照片转化为性视频的中国“脱衣”应用。
Suno与Believe及其分发部门TuneCore达成战略授权合作,允许参与艺术家选择授权模型并获得报酬。此举逆转了Believe在2026年4月对Suno模型的封锁。
OpenAI利用10,000个智能体系统得出了与Navier-Stokes千禧奖难题相关的证明,但承认无法排除该系统从去标识化的Codex使用数据中获益的可能性。
Anthropic 的 Claude 在 11 天内将费马大定理的证明转化为 1300 万行 Lean 代码。数学家认为该成果远超此前的 AI 形式化成就,标志着 AI 在处理复杂数学证明方面取得重大突破。
研究者发布开源蛋白质折叠系统 AtlasFold,该系统基于训练了 15.6 亿个序列的 AtlasLM-3B 模型。在抗体-抗原预测性能上,AtlasFold 已可媲美 AlphaFold3 与 ESMFold2。
研究者推出 Uno 推理加速方案,通过轻量扩散权重与 Psi-Spec 采样器并行提取 token。该方法在无需草稿模型且不损失质量的前提下,可实现最高 3 倍的 LLM 推理加速。
HarvestBench 为一个可复现的基准测试,通过农场仿真评估九款 LLM Agent 的行为。结果显示击杀率在 0.4% 至 98.8% 之间,且该行为受价格与道德提示影响,与模型能力无关。
作者开发了衣壳专用蛋白质语言模型 ESMCapsid,通过筛选 3.43 亿个宏基因组簇,发现了约 62% 的同源未知候选者,并能仅凭序列恢复结构基序。
ENEAS 采用文本提示的统一方法,通过时序记忆与验证层,解决了 SAM 3 中常见的幻觉、碎片化及语义替身问题,实现了自适应分割。
AppLess 发布开源模型 OUI-1,该模型基于 DiffusionGemma 微调,支持在 RTX 5090 等消费级 GPU 上使用 OpenUI Lang 生成可靠的生成式 UI,目前模型权重已上传至 Hugging Face。
技术拆解显示 Claude Code 基于 Firecracker 微虚拟机运行,而 Instinct 则租用 E2B 沙箱,这些技术方案共同实现了 AI 智能体在手机端的运行能力。
一台 128GB MacBook Pro 通过四个 SSD 流式加载 1.45TB 专家权重,成功运行 2.8T 参数的 Kimi K3 模型,解码速度约 1 token/s,预填充被确定为主要性能瓶颈。
布朗大学研究人员使机器人学习日文笔划后,该机器人展现出强大的泛化能力,能够临摹印地语、希腊语、英语、泰米尔语、意第绪语及儿童笔迹等未训练过的内容。
开发者在 Terminal-Bench 2.1、GPQA Diamond 和 IFBench 上对 Qwen3.8 27B 量化版本进行基准测试,结果显示 4-bit 量化性能与 BF16 持平,而 1-bit 量化则接近随机水平。
最高人民法院于9月7日发布首部涉AI司法裁判规则《意见》,旨在明确AI换脸、大数据杀熟等侵权责任,在划定法律边界的同时支持产业发展。
DeepSeek开启V4.1-Flash中间版本内测,该版本采用新模型结构并支持原生多模态,在提升能力与速度的同时,计费标准与V4-Flash保持一致。
Karmada正式从CNCF毕业,该项目拥有1214名贡献者,其v1.19版本强化了分布式AI训练与GPU优先级调度能力。
OpenAI发布GPT-Live工程报告,详解通过异步RPC边界分离媒体处理与应用逻辑,并结合WebRTC与静默测试实现连续有状态的语音交互。
Cohere发布23亿参数的多模态VLM模型Parse 5,可将复杂PDF转换为带边界框的Markdown,在ParseBench测试中获得79.2分。
阿里云、腾讯云等厂商针对企业规模化部署AI Agent推出管理平台,旨在统一治理Agent的身份、权限、审计与成本。