DeepSeek V4.1 Flash 内测+降价最高 60%,把 API 成本与多模态能力同时压到 coding agent 规模化落地的临界点上

科技资讯配图2
今日科技资讯

2026-09-10

1. AI 编程独角兽 Cognition 完成 20 亿美元融资,估值升至 480 亿美元

AI 编程公司 Cognition(产品 Devin)宣布完成超 20 亿美元(约 134 亿元人民币)E 轮融资,估值升至 480 亿美元,较四个月前 260 亿美元近乎翻倍。本轮由 a16z 与 Accel 领投,Founders Fund、General Catalyst 等跟投。在头部模型密集迭代、编程智能体竞争白热化的背景下,资本对「能直接交付代码」的工具体现出更高溢价。

值得关注:编程智能体正从「辅助写代码」迈向「直接交付可运行成果」,资本给出的估值锚点折射出行业对 autonomous coding 的确定性预期。对选型者而言,Devin 类「交付型 Agent」正成为企业研发提效的新基础设施选项。

2. Claude Code 发大版本 v2.1.265/266,Copilot 同步落地企业级沙箱治理

9 月 8 日 Anthropic 推出 Claude Code v2.1.265,覆盖插件加载、prompt-cache 稳定性、Windows 沙箱与 VS Code 会话处理(子代理恢复不再破坏缓存复用、工具结果落盘上限 1GB、Windows AppContainer 下读写不再被整体封锁);数小时后因 gateway 回归问题紧急发布同天 hotfix v2.1.266。同日 GitHub 为 JetBrains 版 Copilot 加入企业托管的本地沙箱策略、跨文件 next-edit 建议与全局项目上下文。本周两家的重心一致:不是新模型,而是治理——资源上限、沙箱锁定、给管理员统一管控杠杆。

值得关注:当编码 Agent 进入企业研发流程,「能执行」已不是竞争点,可观察、可管控、可审计才是。9 月初这轮更新标志 CLI 编程 Agent 从「能力竞赛」转向「治理竞赛」,企业落地选型应重点关注沙箱策略与权限边界。

3. obra/superpowers 把整套开发方法论固化为跨 8 种 harness 的可装 skill

在 9 月 10 日 GitHub trending 中,obra/superpowers(⭐283,899,单日 +690)将完整软件开发方法论封装为可组合 skill 与起始指令:让 Agent 先问清真实目标、拆成规格、写测试驱动实现计划,再进入 subagent 驱动开发;可跨 Claude Code、Codex、Cursor、Gemini CLI 等 8+ harness 安装,不被单一工具锁定。同日 teamai-cli 让团队统一分发 skill/rule/MCP 配置,Pydantic AI v2.42.0 新增 Copilot provider。趋势信号:Agent 生态正从「装了几个 skill」转向「如何把 skill、记忆、流程系统化」。

值得关注:编码 Agent 的竞争正在从「模型/工具」上移到「方法论与工程流程的可复用封装」。把 TDD/YAGNI/DRY 与 subagent 协作固化成跨工具 skill,意味着团队可以把研发规范沉淀为可移植资产,降低对单一 Agent 厂商的绑定。

4. 京东宣布将建成全球最大具身智能数据采集中心

京东 9 月 9 日宣布将建成全球最大的具身智能数据采集中心,计划两年内采集超 1000 万小时人类真实场景视频数据,破解行业「数据荒」;未来 5 年将在全国布局 80 余个 RoboBase 机器人产业基地,覆盖展示交付、维修保养、研发设计、中试组装与数据采集等环节。当前具身智能普遍面临大规模高质量真实交互数据缺口,规模化数据供给正成为竞争基础。

值得关注:具身智能从「本体性能」转向「数据基建」竞争。千小时级真实场景数据直接决定模型泛化与落地速度,京东以产业带规模切入数据供给,预示「数据即护城河」将成为具身赛道的核心变量,值得关注其开源与生态策略。

5. 优必选上半年交付约 600 台 Walker S2 并获复购,推进人形机器人专用芯片

大和报告(9 月 9 日)显示,优必选管理层在业绩后路演中称上半年收入超 10 亿元、同比增逾 100%,交付约 600 台 Walker S2,部分工业客户已复购;公司重申全年收入指引 35 亿元,并预期第四季度有实际机会实现 EBITDA 转正。同时优必选预计具身智能部署将更多依赖边缘计算,并与沐曦合作开发人形机器人专用芯片,以降低云端依赖、提升现场实时决策能力。

值得关注:工业人形机器人从「试用验证」跨入「复购验证」,是商业化拐点的关键信号;专用芯片则指向边缘实时决策与部署成本/稳定性优化。两者共同说明行业焦点已从炫技转向真实场景运营能力与供应链自主。

6. DeepSeek V4.1 Flash 开启内测并下调 V4-Flash 价格,最高降 60%

9 月 8 日 DeepSeek 在官方交流群开启 V4.1 Flash 中间版本内测,新模型采用新架构、原生支持多模态,在能力、速度与成本上进一步优化;9 月 9 日官方宣布自 9 月 10 日 12:00 起下调 deepseek-v4-flash 系列定价:闲时输入缓存命中 0.02 元、缓存未命中 1 元、输出 4 元(每百万 token),高峰时段为 2 倍,最高降幅约 60%(缓存命中输入),V4-Pro 价格不变。此前的 8 月涨价并未完全回撤,输出价仍高于涨价前。

值得关注:对 coding agent 与企业 AI 应用,API 单位成本直接决定规模化调用能否成立;DeepSeek 用峰谷分时 + 缓存命中 30 倍价差,把「可复用调用结构」和「错峰批量」写进商务条款。V4.1 Flash 原生多模态也补上了此前纯文本的能力短板,值得关注其在代码+视觉混合场景的性价比。