今日AI要闻 Meta开源30B端侧Agent模型 宇树中签结果出炉 高盛喊话转向人形机器人

每日 AI 热点速览,侧重 AI Coding 与 具身智能 两条主线。本文筛选当日 10 条高价值动态,每条附事件简述与「为何关注」。
一、AI Coding 方向
1. Meta 开源 30B 端侧 Agent 模型 Muse Glimmer:不联网也能写代码
8 月 10 日,Meta Superintelligence Labs(Alexandr Wang 带队)突然开源 Muse Glimmer——这是 Muse 系列首次开源,直接挂上最宽松的 Apache 2.0 许可证。它是一个 30B 稠密多模态 Agent 模型(27.9B 文本解码器 + 1.9B ViT 视觉编码器,128k+ 上下文),主打「常驻本地的 Agent(always-on local agent)」:能编写代码、调用工具、处理多步骤任务、并从错误中恢复。落地速度极快——发布当天 llama.cpp、Hugging Face Transformers、Ollama 0.32.7、LM Studio、SGLang 全部 day-0 支持,MLX、vLLM 随后跟进,AMD/ARM/Intel/NVIDIA 均参与设备端优化。30B 靠量化 + 分层卸载塞进消费级显卡,本地即可跑完整智能体工作流。
为何关注:这是端侧编程智能体的关键一跃——把「写代码 / 调工具 / 多步推理」从云端搬到本地,既摆脱网络限制,也规避查询数据上云的隐私担忧。对开发者而言,Apache 2.0 意味着可商用、可改、可再分发,配合 Ollama/llama.cpp 生态,个人电脑跑 Agent 的门槛被大幅拉低;也呼应了 Muse Code 的「本地优先」路线。
2. Claude Code v2.1.224:跨会话消息互通 + 自托管执行环境
Anthropic 于 8 月 7 日推送 Claude Code v2.1.224,带来两项面向生产的关键能力。其一是跨会话消息传递(8/9 起被广泛报道):两个用户自己开出的、互不隶属的终端会话可直接互发消息——ListAgents 发现可联系的会话、SendMessage 把消息发过去(仅文字,不能传文件/改配置/批权限),是真正的 peer-to-peer 多 Agent 协作;消息默认本地处理、不上传云端,且外来消息不能私自接管权限。其二是 claude self-hosted-runner:组织可用自己的机器或容器作为 Claude Code web/移动/桌面会话的执行位置(Team/Enterprise 公测),把执行留在自己可控的基础设施上。
为何关注:前者把多 Agent 协作从「主从」推向「对等」,长程并行重构不再需要手动搬运上下文;后者则回答了「在云端跑 agent 不放心」的企业痛点——既能用上 Claude Code 的连接式会话,又能把执行放进自管基础设施,配合 crossSessionInbound/dialogExpiry 等审批边界控制,让多 agent 工作流在企业内「可控落地」。
3. 多智能体走进生产:治理缺口成为八月焦点
8 月多位行业观察与厂商动态指向同一趋势——AI Agent 从试点走向生产,治理缺口随之浮出水面。据 August 2026 Agent 综述,企业已不再满足于单个助手,而是部署「读邮件 / 更 CRM / 标异常」的编排式多智能体网络,并把高风险决策留在 human-in-the-loop;计算机操作型 agent(browser/desktop)在法务、会计、后台岗位已报告显著提效。但「agent 出错谁负责」仍无标准答案,新兴治理实践包括:所有生产 agent 强制动作审计日志(audit log)、不可逆操作设人工检查点、部署前沙箱隔离、对工具调用限速防失控、定期红队演练;提示注入仍被列为「被低估的漏洞」。
为何关注:当 agent 真正跑起业务负载,安全边界就从「模型会不会变坏」变成「流程是否可审计、可追责、可回滚」。这恰好与 Claude Code 的跨会话消息、自托管执行、推理钩子形成配套——harness 与治理层(而非裸模型)开始决定 agent 能不能上生产。对选型者的启示:先看审计与隔离能力,再看模型跑分。
4. Anthropic Enterprise 推 inference hooks:跨全平台的实时 DLP
8 月 6 日,Anthropic 为 Enterprise 计划推出 inference hooks(beta)——在 prompt 与工具调用「到达模型之前」由合规团队的 DLP 服务实时判定放行/拦截,单一策略层覆盖 chat、Claude Code、Cowork 等所有 Claude Enterprise surface,支持影子模式与灰度发布。同一更新还带来 skill/plugin 安全扫描(beta),自动检查第三方上传的 skills/plugins 是否含恶意内容。
为何关注:此前原生内联强制仅限 Claude Code 的客户端 hooks,企业其它 surface 是盲区。inference hooks 把「数据出口审查点」统一到一处,对金融、医疗等强监管行业的 coding agent 落地是刚需——开发者用 Claude Code 写代码、查内部知识时,敏感数据外泄可被同一道关卡实时拦截,无需为每个产品单独集成。
5. Claude Code 安全补丁持续收敛:沙箱凭证遮罩与权限绕过封堵
8 月 4 日与 8 月 6 日的 changelog 继续补强安全面:新增 mode: "mask" 可在 Linux/WSL 上对沙箱内的凭证文件做遮罩——沙箱命令读到的是哨兵副本,真实值由沙箱代理在出口处替换(macOS 回退为 deny);并修复了 zsh 在 [[]] 正则条件里执行隐藏子命令的 Bash 权限绕过、PowerShell 对含引号路径的权限误判、以及 workflow 脚本用动态 import() 跑出沙箱的代码等问题。同时 auto mode 的并行工具调用权限检查改为缓存友好、切换 mode 时可靠弹确认。
为何关注:Black Hat 揭示的「harness 信任边界」之痛,正在以高频补丁形式被持续收敛——从「隐藏子命令 / Unicode 填充 / 沙箱逃逸」一路封堵到「凭证遮罩 / 权限检查缓存」。这再次印证:coding agent 的安全是持续工程,不是一次发布能终结;企业跟进版本、启用沙箱与遮罩,比追新功能更紧要。
二、具身智能方向
6. 宇树中签结果出炉:19,414 个幸运号,8 月 12 日缴款截止
8 月 11 日晚,宇树科技(688836)披露网上摇号中签结果:中签号码共 19,414 个,每个中签号认购 500 股,按发行价 150.80 元/股计,中一签需缴款 7.54 万元,缴款截止日为 8 月 12 日 16:00(网下资金同日 16:00 前到账)。本次网上有效申购户数约 978.46 万户、申购倍数约 8288.82 倍,最终中签率 0.01809759%,创科创板历史新低;网下配售比例 0.0334%,头部量化(世纪前沿、九坤、幻方、明汯等)扎堆入围。按发行价测算,王兴兴直接+间接持股约 33.36%,持股市值约 203.5 亿元;多名 90 后初代员工(2017 年 1 元/股期权)账面浮盈超 150 倍,身价有望过千万甚至过亿。
为何关注:中签率把「人形机器人第一股」的热度写成了硬数据,也立下了赛道首个公开定价锚(市值约 610 亿元、市盈率约 219 倍)。但高估值隐含「家用电脑起步阶段」的成长预期——盈利能否持续、产品是否从展示走向真实生产力,是后市必须回答的命题;对员工与早期资本的造富兑现,则标志硬科技股权激勵进入收获期。
7. 戴盟机器人获蚂蚁领投数亿元战略轮,并发布全球首个触觉锚定世界模型
8 月 11 日,由「全球机器人灵巧操作之父」Matthew Mason 首位博士生王煜创立的戴盟机器人宣布完成数亿元战略轮融资,蚂蚁集团领投、老股东超额跟投;两个月前其刚完成由汇川产投、中国电信联合投资的亿元级 A 轮。至此戴盟已汇聚招商局创投、联想创投、汇川产投、中国移动、中国电信等头部产业资本。更受瞩目的是 8 月 10 日发布的 Daimon-TWM(触觉锚定世界模型)——以原生触觉贯穿物理认知、推演决策与瞬时反应全阶段,让机器人「理解正在发生的接触、预测下一步交互、并据反馈修正动作」,补足视觉看不到的「最后一厘米手感」(力度/形变/滑动)。
为何关注:戴盟押注的是「灵巧操作在于脑,不在手」——具身真正缺的是懂物理、懂交互的「物理交互脑」。触觉世界模型把「很软/偏软/较硬」这类难以用语言或视觉表达的连续差异量化进决策,是机器人从「会动」到「会操作脆弱物体」的关键一跃;蚂蚁领投则显示产业资本正从纯大模型转向「软硬一体的物理交互脑」。
8. 高盛喊话:AI 下一主线从算力转向人形机器人
8 月 11 日,高盛亚洲团队在调研 14 家机器人企业后发布报告,称 AI 投资正从算力竞赛转向人形机器人终端应用,VLA/世界模型加速融合推动规划能力提升,但真实物理数据稀缺仍是瓶颈。其预测:全球人形机器人出货量 2027 年达 7.6 万台、2032 年升至 50.2 万台;亚洲板块估值较美国折价约 21%。同日 A 股机器人板块逆市走强,国证机器人产业指数涨超 2%。
为何关注:卖方旗帜鲜明地把「下一主线」从算力挪到终端,意味着资金叙事正在切换——当算力估值高悬,能落地的物理载体(人形机器人)成为新共识锚。但「亚洲折价 21%」也提醒:同一赛道里,谁能率先用真实订单与场景交付兑现估值,谁才配得上溢价;纯概念将面临回调。
9. 三星整合半导体与 AI,押注韩国版「机器人帝国」
8 月 11 日报道,三星电子正集结集团资源加速自研人形机器人:2026 年 7 月已成立直接向代表理事汇报的 RX 机器人体验事业推进室,依托其制造体系、半导体与 AI 模型能力,目标与特斯拉、英伟达同台竞争具身智能。
为何关注:继特斯拉、英伟达之后,又一家硬件/半导体巨头把人形机器人列为集团级战略——这把竞争从「算法公司单打」升级为「制造+芯片+模型」的全栈比拼。三星的入局意味着具身智能的军备竞赛正扩散到更多制造业强国,也抬高了后来者的供应链与量产门槛。
10. 特斯拉 Optimus 周产将破千台;中国机器人以「场景定制」撬动出海
最新调研显示,特斯拉 Optimus 9 月周产量将稳定突破 1000 台,弗里蒙特与奥斯汀双工厂并行爬坡,Gen3 定于 2026 年三季度亮相,量产拐点已至。与此同时,中国机器人正从「卖硬件」转向「场景定义硬件」的一体化方案出海:8 月 11 日青岛开出首家含个性化定制的机器人 6S 体验店;深圳我能具身的双手臂通用人形机器人已在广州邮区中心快递分拣流水线试点(峰值 1200 件/小时),获外交部全球推介;海关总署数据显示上半年工业机器人出口额 62.9 亿元、同比增 18.6%,手术机器人出口激增 3.3 倍。
为何关注:两端信号共振——海外看「量产拐点」(Optimus 破千台/周),国内看「场景落地+出海」(分拣产线、6S 店、出口高增)。具身智能正从 Demo 年跨入「分化+兑现」年:谁能把机器人稳定塞进真实产线与海外场景、用连续作业时长说话,谁就拿到下一程门票。
小结
今天两条主线都指向「从能力走向落地与治理」:AI Coding 一边把 agent 搬到本地(Muse Glimmer 30B 开源)与自管基础设施(Claude Code 跨会话消息 + 自托管执行),一边补强合规与审计(inference hooks 实时 DLP、沙箱凭证遮罩、动作审计日志),核心命题是「harness 与治理层决定 agent 能否上生产」;具身智能则站上资本与量产双风口——宇树中签结果出炉立下定价锚、戴盟以触觉世界模型补齐「物理交互脑」、高盛把主线从算力转向人形机器人、三星与特斯拉加码全栈与量产,行业正从「秀肌肉」转入「订单验成色」的兑现期。