Why teens deserve access to safe AI
OpenAI 致力于提升 ChatGPT 对青少年的安全性,通过引入适龄保护机制、学习工具、家长控制功能以及专家合作伙伴关系,确保青少年能够安全地访问 AI 资源。
现有基准侧重于考试答题而非课程结构的认知。通过引入课程认知能力(如先修链和概念分类),可提升教育大模型对知识结构化理解的准确性,从而更有效地支持K-12教学。
OpenAI 致力于提升 ChatGPT 对青少年的安全性,通过引入适龄保护机制、学习工具、家长控制功能以及专家合作伙伴关系,确保青少年能够安全地访问 AI 资源。
OpenAI 推出 ChatGPT 小企业计划,旨在帮助创业者通过 ChatGPT Work 提升 AI 技能、实现工作自动化并推动业务增长。
OpenAI 与 Hugging Face 就模型评估期间的安全事件分享初步调查结果,重点分析先进的网络攻击能力,并为防御者提供经验教训。
OpenAI 发布 GPT-Red 自动化红队系统,该系统利用自我博弈机制提升 AI 的安全性、对齐能力以及针对提示词注入攻击的鲁棒性。
OpenAI 推出企业级 AI 智能体平台 OpenAI Presence,支持组织部署可信的语音和聊天智能体,以优化客户服务及内部工作流。
Meta 正在升级其 AI 聊天机器人,通过引入日历同步功能以协助用户规划活动并生成每日简报,同时支持可由用户引导的深度研究。此举旨在增强其生产力功能,从而在与 Gemini、ChatGPT 和 Claude 的竞争中占据优势。
OpenAI 将具备全双工语音控制能力的 GPT-Live 音频 AI 模型引入 Codex 及 macOS 和 Windows 端的 ChatGPT 桌面应用程序。该功能支持同时听讲,旨在将更自然的人机交互直接集成到开发者的工作流中,实现无需手动操作的代理式编程。
OpenForgeRL 旨在解决现代 AI 智能体依赖复杂推理框架导致难以使用开源基础设施进行端到端训练的问题,通过提供一种原生训练方案,使智能体能够在任何环境中进行 SFT 和 RL 训练。
该研究提出一种评估空间认知的新方法,主张通过生成像素(如指向、标记或绘制)而非 LLM 文本来评估空间智能,以更自然地表达连续视觉场景中的位置、区域和路径。
该研究通过一项针对主动观察者的测试,探讨多模态大语言模型是否具备类似人类视觉的闭环能力,即能否通过中间假设不断重新定向注视点,而非仅依赖单次快照。
NVIDIA-labs 推出 OO Agents (NOOA),这是一个模型无关的 Python 框架。它将智能体定义为 Python 对象,通过对象方法简化传统开发中提示词模板、工具模式和工作流图的碎片化问题。
SANA-Video 2.0 采用混合线性注意力机制与注意力残差,在 5B 和 14B 规模下实现了高效的视频生成。该架构在单 GPU 上可生成 720p 高质量视频,且在保持长序列优势的同时媲美全 softmax 视频 DiT。
该研究探讨了针对智能体任务的多轮在策略蒸馏 (OPD),通过引入前缀回放 (Prefix Replay) 机制,旨在降低完全在线 OPD 在多轮环境交互中因频繁进行学生端采样而产生的高昂成本。
阿里巴巴开源代码审查工具 open-code-review 采用确定性流水线与 LLM Agent 的混合架构,支持精准的行级注释。该工具内置针对 NPE、线程安全、XSS 及 SQL 注入的微调规则集,兼容 OpenAI 和 Anthropic 接口,具备大规模工业级验证经验。
citrolabs 推出的 ego-lite 是一款专为 AI Agent 打造的高速浏览器,旨在实现 Web 自动化。该工具支持将已登录的浏览器状态共享给 Codex 或 Claude Code 等 AI Agent,且无需配置、零成本,可在不干扰用户的情况下运行。