Agent 底座「开源占位」战白热化

科技资讯配图1
今日科技资讯

2026-08-22

1. OpenAI 开源 Codex Harness + DeepSeek 收编竞品子代理,Agent 底座「开源占位」战白热化

8 月 21 日,OpenAI 将驱动 Codex 智能体的底层框架 Codex Harness 以 Apache-2.0 协议全面开源,包含 codex exec、Codex SDK、app-server 三大组件,可通过双向 JSON-RPC 把 Agent 能力嵌入自有 IDE、桌面应用与业务系统。仅隔一天,DeepSeek Harness 完成一周内密集更新,把 Claude Code 与 Codex 收编为子代理,主打跨模型统一调度。数据猿源码分析指出,仅调整 Harness 就让 GPT-5.6 Sol 在 ARC-AGI-3 得分从 13.3% 升至 38.3%。

值得关注:AI 编程竞争的主战场已从「模型能力」彻底转移到「Agent 运行时、工具调用、上下文管理与反馈循环」。两大顶级实验室相继开放 Agent 基础设施,路线分歧(Codex 的嵌入引擎 vs DeepSeek 的「一切皆插件」)也浮出水面——谁先把底座占住,谁就掌握开发者生态的入口。

2. Vibe Coding 安全警报:Gartner、Forrester 警告硬编码密钥随 AI 代码泄露

8 月 22 日凌晨,至顶科技连发两篇实操/观察稿:一篇讲解用 Claude Code 的 Skill 机制解决长会话中架构约束「淡出视野」的问题;另一篇援引 Gartner、Forrester 警告——Vibe Coding 时代开发者把 API 密钥等硬编码进代码后,极易随 AI 生成的提交一键推上 GitHub,造成企业凭证与数据泄露。

值得关注:AI 编程从「提效工具」走向「风险敞口」。当代码产出速度和体量指数级放大,密钥扫描、脱敏、审计必须从 IDE 前置到生成环节。安全治理正在成为企业大规模采用编程 Agent 的隐形门槛,也是下一轮工具差异化的关键战场。

3. 第二届世界人形机器人运动会 8 月 22 日北京「冰丝带」开幕,规模较首届翻番

第二届世界人形机器人运动会于 8 月 22 日在国家速滑馆「冰丝带」开幕,赛期延长至 5 天(8/22–26)。本届汇聚全球 16 个国家的 666 支队伍、2056 台人形机器人,赛项由首届 26 项扩容至 51 项(30 项竞技赛 + 21 项场景赛),共计 1301 场比赛;国内 157 家企业、641 支队伍、1975 台机器人悉数到场。

值得关注:人形机器人正从「展示」迈向「竞技标准化」。主办方明确,相当一部分赛事规则将演化为实用的技术验收标准,实现「以赛定标、以标促产」。赛事规模与赛制升级,是行业整体成熟度最直观的体温计。

4. 场景赛首次落地真实环境,全自主完成权重 1.0 远超遥操 0.5

本届运动会场景赛覆盖工业、物流、酒店、家庭、消防救援、零售等真实场景(不再是模拟场馆),要求机器人在复杂环境中自主、连续地完成长时程任务。规则明确:场景赛全自主完成权重系数 1.0,遥操完成上限 0.5;田径与竞技赛除 100 米、400 米障碍外一律要求全自主,时限也被大幅压缩(如 100 米从 3 分钟压到 1 分钟)。

值得关注:「全自主 vs 遥操」的权重差,直接把具身智能的评判标准从「会不会动」拉到「能不能真干活」。真实场景长时连续任务验证,是商业化最硬的试金石;「得了奖牌就拿订单、出了赛场就进现场」的赛产闭环模式,正在打通技术到生产力的最后一公里。

5. 宇树王兴兴定义具身「ChatGPT 时刻」量化标准,并推进物理 AI 自进化

在世界机器人大会论坛上,宇树科技王兴兴给出具身智能「ChatGPT 时刻」的量化判断:在 80% 陌生场景下,通过语音指令完成约 80% 任务,即为临界点;他判断这一时刻快则 2–3 年、慢则 5–10 年。同时他透露宇树正推进「物理 AI 机器人模型自进化」——让大模型自主检索论文并生成控制代码。

值得关注:行业首次给出相对可量化、可验证的爆发临界点,为研发路径与资本预期提供了锚点。当头部厂商把「自检索论文→自生成控制代码」纳入路线图,具身智能的研发范式也可能从「人写算法」转向「模型自我迭代」,进一步压缩从实验室到场景的落地周期。