AI日报 发表于 2026-8-3 09:34:57

UU每日AI新闻分享-2026年08月03日

UU 每日 AI 新闻分享 - 2026 年 08 月 03 日

当日 AI 圈动态精选(5 条),侧重 AI coding 与 具身智能 两个方向。整理自 AI HOT(aihot.virxact.com)。



1. Codex 用 Sol 指挥 Luna Max,省额度翻倍产出


[*]来源:X:阿易 AI Notes(@AYi_AInotes)
[*]时间:2026-08-02 18:47(北京时间)
[*]摘要:Codex 的高阶玩法:在 ~/.codex/agents/ 下让 Sol 创建 luna-worker.toml 子代理,把模型设为 gpt-5.6-luna、reasoning effort 设为 max,让 Sol 负责拆任务和审代码,具体实现自动委托给 Luna Max。
[*]链接:https://x.com/AYi_AInotes/status/2083867265179537565
[*]为什么值得关注:这是当前 OpenAI Codex 多代理编排最实用的"省钱"模板——把贵模型(Sol)当调度器、便宜模型(Luna)当执行器,思路可以平移到 Cursor / Claude Code / Droid 等多代理 IDE,对个人开发者和企业降本都有直接参考价值。




2. 面壁智能 ALIGN:自动对齐智能体与环境接口


[*]来源:X:面壁智能 OpenBMB(@OpenBMB)
[*]时间:2026-07-31 21:00(北京时间)
[*]摘要:ALIGN(Agent-environment aLIGNment)研究智能体与不同环境的接口对齐问题,自动学习适配不同操作空间、API 形态、反馈信号,让同一个智能体策略可跨环境迁移。
[*]链接:https://x.com/OpenBMB/status/2083175856563003724
[*]为什么值得关注:当前 AI coding / Agent 最大的"最后一公里"瓶颈是工具/环境异构——ALIGN 把"环境接口对齐"做成一类独立问题,是具身智能、Web Agent、IDE Agent 都要面对的共性挑战,对做 Agent 框架和工具调用层的人有直接启发。




3. DeepSeek V4 Flash 0731 开源,登顶开源模型前三


[*]来源:X:Artificial Analysis(@ArtificialAnlys)
[*]时间:2026-07-31 21:38(北京时间)
[*]摘要:DeepSeek 发布开源模型 DeepSeek V4 Flash 0731,Artificial Analysis 智能指数 50,位列开源模型前三。MIT 许可,总参 284B(激活 13B),FP4/FP8 混合精度约 167GB,已同步上线官方 API。
[*]链接:https://x.com/ArtificialAnlys/status/2083306229074739285
[*]为什么值得关注:V4 Flash 把"小激活 + 大总参"路线推到新阶段,单卡 167GB 就能跑,AI coding / 本地 Agent 部署成本进一步下降;同时官方 API 也补强了 Agent 能力,是当下做开源/私有化 Agent 栈最值得拿来对比的基线。




4. Google DeepMind 发布 Gemini Robotics 2 物理 AI


[*]来源:X:Google DeepMind(@GoogleDeepMind)
[*]时间:2026-07-30 23:02(北京时间)
[*]摘要:One brain. For any robot. —— Gemini Robotics 2 是 DeepMind 下一代物理 AI,主打全身智能、高阶灵巧操作、多机器人团队协作,目标是同一套模型驱动不同形态的机器人。
[*]链接:https://x.com/GoogleDeepMind/status/2082844162928381956
[*]为什么值得关注:从 RT-2 到 GR-1 再到 GR-2,DeepMind 一直在做"通用机器人底座模型"。GR-2 把"灵巧 + 多机协作 + 全身控制"打包交付,配合 ER 2 的视频理解编排,是当前具身智能领域最接近"GPT 时刻"的发布。




5. PhiZero:围绕"物理语言"构建的世界模型


[*]来源:HuggingFace Daily Papers(社区热门论文)
[*]时间:2026-07-30(论文)
[*]摘要:PhiZero 提出一种"物理语言"——从野外视频中自监督学到、描述世界状态转移的紧凑离散表征。它采用"先推理后渲染"范式:先用物理语言序列推演未来,再用扩散解码器渲染成视频。在物理一致性、细粒度动作条件、零样本运动迁移上均验证有效。
[*]链接:https://arxiv.org/abs/2607.28624
[*]为什么值得关注:这是具身智能里"世界模型 + 视频生成"路线的代表作——把"物理规律"学成一种可推理的离散语言,再让扩散模型只负责"成像",思路比 Sora 路线更接近机器人控制所需的"因果可推演"属性,对做仿真/世界模型的人是必读论文。




本日小结:3 条围绕"AI coding / Agent 工具栈"(Codex 子代理、ALIGN 环境对齐、DeepSeek V4 Flash 部署成本下降),2 条围绕"具身智能"(Gemini Robotics 2 通用底座、PhiZero 物理世界模型),共同指向"模型 + Agent + 物理执行体"正在被同一条技术链串起来。
页: [1]
查看完整版本: UU每日AI新闻分享-2026年08月03日