AI 日报|Gemini 3.7 Flash 与 GLM-5.3 同台竞技,中国人形机器人包揽全球 97% 出货

今日核心判断:AI Coding 的军备竞赛从「谁的模型更强」切换到「谁迭代更快、谁更便宜、谁的执行层更开放」。Google 用三周一更的 Gemini 3.7 Flash 把价格砍到对手一半,智谱用 GLM-5.3 把开源编程能力推上新台阶,DeepSeek 用 Harness 把 Agent 执行层直接开源。具身智能这边,「规模化出货 + 资本化」双线并进——中国人形机器人 H1 吃掉全球 97% 出货,宇树 IPO 与物理 AI 百亿基金同步点燃市场。
一、AI Coding 与智能体
1. Google 发布 Gemini 3.7 Flash:三周一更,价格砍半
事件:8 月 14 日,Google 发布 Gemini 3.7 Flash,距离上一版 3.6 Flash 仅隔三周,被定位为面向编程与 Agent 工作流的「主力型」模型。编程能力大幅跃升:DeepSWE v1.1 从 49.0% 升至 65.3%,FrontierCode 1.1 Main 从 34.4% 升至 43.6%,WebDev Arena Elo 从 1538 升至 1588,企业自动化 AutomationBench 从 17.0% 升至 30.4%。定价上,2026 年底前每百万输入 token 0.75 美元、输出 3.75 美元——仅为 3.6 Flash 首发价的一半,2027 年起才上调回 1.5 / 7.5 美元。
值得关注:Flash 原本靠速度与价格打市场,如今能力上限正快速逼近旗舰。Google 用「高频迭代 + 半价 + Workspace / Cloud / Android 现成分发入口」的组合,提前抢真实生产环境。对 Coding Agent 与企业级工作流而言,调用成本被迅速放大,Flash 正成为 Agent 后台那个「长期在线、持续干活」的主力模型。
2. 智谱发布 GLM-5.3:号称最强开源编程模型,较上代提升 50%
事件:8 月 14 日,智谱正式发布 GLM-5.3。基座不变,通过后训练 Scaling(数十倍长程任务环境、更丰富环境类型、超长后训练时间)大幅抬升智能上界。官方称其为当前排名最高的开源模型,编程与智能体能力接近 Claude Fable 5,编程体感超过其他国产模型。在自研 Z.ai Code Bench 上,High 档位准确率 31.4%,超过 Claude Opus 4.8 最高档的 29.5%,且每项任务平均仅输出约 5 万 token(Opus 4.8 需约 12 万),执行路径更短。即日上线 ZCode、AutoClaw 等编程工具,并开放完整模型权重(两周内开源,先做安全加固)。
值得关注:开源编程模型的能力天花板又被抬高一档。对国内开发者而言,这意味着在 Claude / GPT 之外,多了一个可自托管、成本可控的 Coding Agent 底座选项,且已接入 Trae、WorkBuddy、CodeBuddy、Qoder 等主流编码平台抢先体验。
3. DeepSeek 开源 Harness(DSH):GitHub 史上最快涨星,补 Vibe Coding 入口
事件:8 月 13 日晚,DeepSeek 发布并开源 DeepSeek Harness(DSH)开发者预览版(MIT 协议)。它是一套 Agent 运行框架,把大模型接入文件系统、终端、网页、代码工具及其他 Agent,负责上下文管理、工具调用与任务执行,公式即 Model + Harness = Agent。架构贯彻「一切皆插件」:基于 Cordis 插件元框架,模型、工具、技能、沙箱、存储、循环、调度、UI 全部可替换;预置标准 / PTC 程序化调用 / 极简 / 创造四模式,兼容任意 OpenAI API 兼容后端(含 Ollama / vLLM 本地部署)。发布约 1.5 小时 GitHub Star 突破 2.4 万,被称为 GitHub 史上最快涨星项目。
值得关注:DeepSeek 从「卖模型 + API」正式切入 Claude Code、Codex 所在的 AI 编程执行层。对开发者而言,又多了一个开源、可自托管、模型无关的 Agent 工作台;对行业而言,Agent 基础设施的开源之战被彻底点燃。
4. Claude 全模型加隐形水印:欧盟 AI 法案长臂管辖全球,引发争议
事件:自 8 月 2 日欧盟 AI 法案第 50 条生效起,Anthropic 对 8 月 2 日后发布的 Claude 模型在生成文本时嵌入不可感知的隐形水印,并随复制粘贴穿越全网;对 .svg / .png / .jpg 等文件则附加 C2PA 数字签名来源元数据。该政策覆盖 Claude 全产品线(含 Claude Code、API、Cowork、Tag)及 AWS / Google Cloud / Microsoft Foundry 等云通道,全球适用、无退出开关。驱动力是欧盟合规(罚款上限 1500 万欧元或全球营收 3%),但 Reddit 等社区出现明显不满——用户担忧自己的改写、翻译、摘要作品被「贴上 AI 文身」。
值得关注:这是「布鲁塞尔效应」在 AI 圈的典型案例:一家美国公司因欧盟法规改变全球所有用户的文本输出。对 Coding Agent 用户而言,Claude Code 生成的代码与注释同样会被打标;水印是「信号而非证据」(只表明内容可能经 Claude 处理),且在格式转换 / 重存后可被剥离。创作归属与言论自由的边界争议,才刚刚开始。
5. Vibe Coding 资本热:Lovable 估值破 133 亿美元,赛道融资超 35 亿美元
事件:8 月 12 日,瑞典 Vibe Coding 初创 Lovable 完成 4 亿美元 C 轮,投后估值 133 亿美元,腾讯参投;2025 年 8 月至今该赛道融资已超 35 亿美元。与此同时,市场传出 Cursor 被以约 600 亿美元估值收购的消息;预计 2026 年全球 Vibe Coding 市场规模翻倍至 47 亿美元。AI 产品榜 7 月数据显示,Claude 月访问量达 9.89 亿创历史新高,DeepSeek Harness 开源加速了「办公智能体(Work Agent)」赛道的混战。
值得关注:Vibe Coding 正从极客玩法走向主流生产力工具,资本用真金白银下注「自然语言即开发」的范式。但赛道也在分化:单功能 AI 产品(如 AI PPT)全线下跌,而「能端到端干活」的 Agent 平台成了新宠。
二、具身智能与人形机器人
6. 中国包揽 H1 全球 97% 人形出货,智元登顶、宇树第二
事件:行业统计显示,2026 年上半年全球人形机器人出货约 1.91 万台(同比 +272%)。中国厂商占 97%+,其中智元 AgiBot 约 8400 台、44% 份额(+562% YoY)首次登顶,宇树 Unitree 约 5900 台、31% 份额居次,两家合计约占四分之三;Galbot、优必选、乐聚等第二梯队分别约 900 / 700 / 600 台。更关键的是,H1 超 70% 出货流向工业与商业场景(制造、仓储、物流),较去年约一半明显上移;研究机构预计全年逼近 6 万台,2030 年或达 50 万台。
值得关注:头部两家与身后玩家已拉开「台阶差」。中国正在定义人形硬件的默认价格与交付周期;下一关考验是「把出货变成可重复、可计量的在岗工作」,而非漂亮的演示视频。
7. 宇树科创板 IPO:发行价 ¥150.80,市值约 ¥610 亿,人形第一股登场
事件:8 月 10 日,宇树科技(688836)正式启动科创板申购,发行价 150.80 元 / 股,发行 4045 万股(占总股本 10%),募资约 61 亿元,对应市值约 609.9 亿元(约 90 亿美元),发行市盈率 219.23 倍。从 3 月 20 日 IPO 申请获受理到正式申购不到 5 个月,创下年内最快审核纪录;散户超额认购约 8288 倍,网上中签率低至 0.0181%。DeepSeek 通过战略配售获 2.31% 股权,双方约定在机器人 AI 模型上合作;腾讯、社保基金等亦参与战略配售。
值得关注:这是「硬件规模 → 资本市场」的里程碑式兑现,为后续排队上市的具身智能公司确立了估值锚点。募资超八成投向研发,其中智能机器人模型投入首超本体研发——行业竞争焦点正从「比拼硬件肌肉」转向「攻坚智能大脑」。
8. 物理 AI 进入规模化验证期:首程设 35 亿基金,Momenta 成港股物理 AI 第一股
事件:宇树 IPO 标志性事件之外,首程控股作为宇树核心战略投资方,联合多方设立 35 亿元前沿科创新兴未来产业股权投资基金,专项重仓物理 AI 全产业链。据不完全统计,最近 18 个月超百亿美元涌入物理 AI 赛道,仅 8 月就有飞捷科思、西湖数智、慧仑科技等密集拿到数亿元融资;2026 年首轮融资占比降至 8%,92% 资金集中投向有落地订单、成熟产品的头部企业。自动驾驶作为物理 AI 另一核心场景同步兑现:7 月「物理 AI 第一股」Momenta 登陆港交所(募资约 58.9 亿港元,奔驰、比亚迪、GIC、富达参投),并获德国全境 L4 测试许可,量产车搭载规模突破 100 万台。
值得关注:黄仁勋将物理 AI 定义为「让 AI 从看懂世界升级到改变世界」。资本不再撒胡椒面,而是下注「订单 + 线下场景 + 真实交互数据」——首程资本直言行业「不缺资金,稀缺的是订单、场景与数据」。
9. 智元 × 魔珐:具身交互智能落地灵犀 X2,机器人进社区
事件:8 月 12 日,智元 AGIBOT 与魔珐科技宣布围绕灵犀 X2 展开合作。灵犀 X2 是智元面向导览导购、文娱商演、科研教育等场景的人形机器人;魔珐星云则是端到端具身交互智能平台,具备从感知、理解、生成到具身表达的完整能力。双方通过系统协同,将对话内容转化为相应的语音与身体动作表达,并已在上海徐汇枫林街道落地——机器人以「社区志愿者」身份进入社区服务、科普讲解、长者服务、儿童成长与社区食堂等场景,与不同年龄居民面对面互动。
值得关注:当机器人进入展厅、门店、酒店、公共服务等直面用户的场景,评价标准从「能不能干活」变为「会不会表达」。具身交互智能(语音 + 表情 + 身体动作协同)正成为连接机器人智能能力与实际用户体验的关键环节,也是中国厂商在「规模领先」之后补「体验领先」的切入点。
10. 行业资本化浪潮:港股 51 家机器人企业排队,前八月融资破 1217 亿
事件:据《科创板日报》梳理,宇树启动申购并非孤立事件——港股已有 51 家机器人相关企业排队 IPO,今年前八个月国内机器人赛道融资额突破 1217 亿元,远超去年全年。智元创新正式启动物港上市流程,乐聚智能、云深处科技 IPO 申请相继获受理;优必选 Walker S2 工业人形机器人持续落地车企与电子制造工厂,订单规模攀升。政策端,国家将人形机器人与具身智能纳入未来产业重点规划,科创板绿色通道、港股 18C 章等制度进一步打通硬科技企业上市路径。
值得关注:资本化对行业是双向重塑:上市募资为长期研发提供稳定弹药,二级市场估值体系成为「校准器」,缺乏真实订单、无法形成商业闭环的纯概念企业将加速出清。行业分化与洗牌,正在从一级市场蔓延到二级市场。
小结
AI Coding 与具身智能在 8 月 15 日这天形成了清晰的呼应:前者在「迭代速度、价格、执行层开放度」上贴身肉搏(Gemini 3.7 Flash 半价抢场景、GLM-5.3 抬高开源上限、DeepSeek Harness 开源执行层、Claude 水印引发归属争议);后者在「规模化出货与资本化」上加速兑现(97% 全球份额、宇树 IPO、35 亿物理 AI 基金、51 家排队敲钟)。两条线共同指向同一个底色——从「能力演示」走向「真实工作 / 在岗作业」,而可靠性、标准化与订单,将是下一阶段真正的分水岭。