全球首个 Stencil 系统,一周重构 100+ 工业软件;具身智能迎「触觉觉醒」…

科技资讯配图2
今日科技资讯

2026-08-05

1. 面壁智能开源 ForgeStencil:全球首个 Stencil 优化全自动闭环系统,一周重构 100+ 工业软件

8月4日,面壁智能联合 OpenBMB 开源社区发布全球首个面向 Stencil(模板计算)优化的「自动研究+自动部署」大闭环 AI 系统 ForgeStencil。用户只需提供待优化的应用源码,系统即可自动完成真实应用分析、热点函数定位、Kernel 锻造、算子替换、正确性验证与集成回原应用,全流程无需人类专家介入。在 100 余个真实工业与科学计算软件上,ForgeStencil 用一周时间完成了重构优化,覆盖 CAE 仿真、流体力学计算、电磁 EDA 等高性能计算场景。该系统是继 5 月底 ForgeTrain(全球首个完全由 AI 编写的大模型预训练框架,训练速度较英伟达 Megatron 快 10%)之后,面壁智能在「锻造工程」(Forge Engineering)软件工程新范式下的又一成果。

值得关注:高性能计算软件的性能优化长期依赖少数专家手工精调,人均每年优化不超过 20 个应用。ForgeStencil 首次实现从「提出优化想法」到「应用无缝部署」的全自动闭环,意味着 AI Coding 正在从「写代码」进入「改造 legacy 系统、释放算力」的深水区,对国产工业软件自主可控具有直接战略价值。

2. 具身智能迎「触觉觉醒」:视触融合有望打破物理 AI「最后一厘米」鸿沟

8月5日《证券时报》报道,触觉感知正成为具身智能领域增长迅猛的细分赛道,今年前 7 个月新增融资超 70 亿元,至少两家企业跻身新晋独角兽。此前主流 VLA(视觉—语言—动作)模型依赖视觉与语言做决策,但机器人看不见被遮挡部分、易碎物或柔性操作仍离不开力度把控。2025 年末至 2026 年初,头部企业研发资源向触觉倾斜,VTLA(视觉—触觉—语言—动作)模型需求日益高涨。行业认为,将触觉信息融入具身大模型是提升机器人柔性操作能力的主流方向,依托视触融合技术的工业柔性操作已诞生应用测试场景,规模化量产有望上线,但触觉数据的不可替代性仍是数据缺口核心瓶颈。

值得关注:从「看得见」到「摸得到、做得好」,触觉是机器人从 Demo 走进真实工业场景的必经之路。该报道揭示了具身智能从 VLA 到 VTLA 的范式迁移,以及资本正从本体硬件向传感器、数据、模型等「软能力」聚集,预示行业将进入触觉硬件+数据+模型协同创新的新阶段。

3. 比亚迪首款人形机器人 8 月亮相汽车展厅,人形机器人首站从产线跳向零售

据 CnEVPost 及中国财经媒体报道,比亚迪将于 8 月初在郑州 Di Space 体验场馆发布首款自研人形机器人,首秀场景并非焊装车间,而是汽车展厅销售顾问。比亚迪执行副总裁李星公开表示,目标「每家经销商放 2–3 台机器人」,1–2 年内机器人销售顾问可真实上岗。比亚迪自 2024 年底在第 15 事业部组建具身智能团队,2026 年 8 月首秀墨西哥 Shark 插混皮卡发布会同场后落地国内展厅。首批任务定位为讲解电池保修、指点配置、吸引观众——工程门槛低于工厂工况,却能在比亚迪控制的门店网络中持续采集交互数据,形成数据飞轮。

值得关注:当特斯拉 Optimus 仍聚焦工厂产线时,比亚迪选择从零售场景切入,用可控的经销网络快速积累真实交互数据并建立用户心智。这一路径降低了首次落地的工程难度,同时让机器人更快触达消费者,可能成为人形机器人规模化商用的另一条主线。

4. Y Combinator 开源企业级多智能体 harness QM,AI 编程进入「公司级多人协作」编排层

7 月 31 日,Y Combinator 宣布开源其内部使用的多智能体 harness QM。该产品被 YC 描述为面向整家公司而非单个用户的「multiplayer」编排系统,已在其会计、法务、活动和工程团队中使用,包括 QM 项目自身的持续开发。QM 采用云优先架构,内置 Slack 与 Web 界面,基于 MIT 协议发布在 yc-software GitHub 组织。其核心特点是模型无关:同一编排循环可驱动 Pi、OpenCode、Codex 或 Claude Code 等底层模型。发布恰逢 AI Coding 领域从单一模型能力竞争转向 harness(沙箱、记忆、权限、工具接入)竞争的节点。

值得关注:QM 的发布标志着 AI Coding 的基础设施层正在从「个人助手」走向「企业级多 Agent 协作」。当底层模型能力趋于接近时,orchestration、记忆、权限和沙箱将成为工程团队差异化的关键。YC 将内部工具开源,可能加速企业 AI Agent 编排标准的形成。

5. BenchLM 编程排行榜刷新:Claude Mythos 5 登顶,开源与闭源 AI 编程 Agent 差距持续收窄

8 月 2 日,BenchLM 更新了结合 SWE-bench Pro 与 LiveCodeBench 的编程排行榜。Claude Mythos 5 以 80.1 的复合分排名第一,Claude Fable 5 以 79.8 紧随其后,GPT-5.6 Sol 为 78.4,前三名差距不足 2 分。同期 MightyBot 对完整 coding agent 的评估则显示,Claude Code 凭借 Claude Opus 5 与子 Agent 模型控制位列第一,Codex 第二并保持 Terminal-Bench 纪录,Kimi K3 作为最强开源权重模型入榜。Faros AI 等行业分析指出,coding agent 应被理解为「模型 + harness」,编排层的重要性已与模型本身相当。

值得关注:排行榜不仅反映了模型能力的激烈胶着,更揭示了评估范式的转变:从单纯比较模型输出,转向比较完整 agent 在真实工程工作流中的表现。开源权重模型(如 Kimi K3)进入第一梯队,意味着闭源实验室的领先窗口正在收窄,企业选型将更多取决于 harness 与现有工具链的集成能力。