2026-08-14 · 国产 Harness 开源与 auto 模式落地
2026年8月14日阅读时长约 1 分钟
8/14 主线:AI Coding——DeepSeek Harness 开源公测(模型+Harness)、Claude Code auto mode 默认(89% 拦截 vs 13.6% 人工)、Gemini 3.7 Flash 降价 50%(DeepSWE 49→65.3);具身:机器人运动会 8/22 北京开赛(2056 台/16 国)、戴盟触觉世界模型 Daimon-TWM 获蚂蚁领投。
1. DeepSeek Harness 正式开源公测:国产 Agent 基础设施补上"执行层"
- 事件内容:
- 8 月 13 日晚至 14 日凌晨,DeepSeek 发布首款智能体产品 DeepSeek Harness(v0.1 开发者预览版),同步以 MIT 协议全面开源并面向全球开发者开放公测。官方给出核心公式:模型(大脑)+ Harness(身体)= Agent。
- 设计理念为"一切皆插件":底层模型、调用工具、数据存储与交互界面均可自由替换与重组,原生兼容 DeepSeek 自家及 Kimi、OpenAI、谷歌等海内外数十款主流模型,不被单一模型绑定。功能覆盖项目管理、长任务协作、多智能体编排、上下文管理、联网搜索、调用外部技能。
- 针对长任务痛点,框架提供多智能体编排、自动存档、断点续传、联网检索等能力,支持跨多步骤大型项目协同执行;此前已在部分国产厂商内部内测,社区评价其"从顾问变能自己干活的员工"。
- 值得关注原因:这是国产大模型从"只提供模型"走向"模型 + 执行装置"闭环的关键落子——呼应近两周"harness 成主战场"的判断,DeepSeek 用 MIT 开源直接切入 Codex/Claude Code 对标赛道,且不像闭源工具形成生态垄断。对企业而言,插件化 + 跨模型兼容意味着可低成本搭建自有 Agent 底座、掌握执行层标准话语权;对开发者,开源生态有望快速沉淀插件市场与场景模板。需关注 API 调价对成本的影响。
- 来源:都市快报橙柿互动 · DeepSeek Harness 发布 · 东方财富 · Harness 预览版与开源 · 微博 · Harness 开源解读
2. Claude Code auto mode 8 月 14 日全球默认开启:自主性 + 安全护栏并进
- 事件内容:
- 自 2026 年 8 月 14 日起,Anthropic 将 auto mode 设为 Claude Code 在 Pro、Max、Team 账户上的默认运行设置,移除标准迭代式用户验证提示,使 AI 编码代理能自主执行多文件修改、运行测试、部署 PR,仅在操作被标记不可逆、破坏性或针对外部环境时停下。
- 安全侧:Anthropic 对 1,053 名付费软件测试人员的受控基准显示,auto mode 拦截 89% 的恶意行为,而因权限疲劳的人工操作员仅拦截 13.6%(历史上用户点击批准 97% 的权限提示而未做安全验证)。为此上线了提示注入筛选与可自定义硬拒绝规则。企业版与 API 层预计 9 月 14 日跟进。
- 值得关注原因:这把"agent 自主化 vs 安全可控"的权衡用实测数据摆上台面——自动化护栏反而比人工更安全,对"是否该让 agent 全自动跑"的争议给出行业级参照。对工程团队,默认值切换意味着 coding 工作流正式进入"后台长程异步"阶段;对国内 harness/agent 厂商,安全护栏设计(提示注入 + 硬拒绝)成为必备项。Enterprise/API 延后说明企业级审计仍在打磨。
- 来源:jqjo · Anthropic Auto-Enables Non-Stop AI Coding Agents · 中文版
3. Google 发布 Gemini 3.7 Flash:编码/agent 专用"主力马"价格砍半
- 事件内容:
- 8 月 14 日,Google 发布 Gemini 3.7 Flash——一款专为编码与智能体工作流优化的"主力工作马"模型。官方数据:软件工程能力 DeepSWE v1.1 从 49.0% 升至 65.3%,FrontierCode 从 34.4% 升至 43.6%,调试、UI、网页开发、游戏制作、PDF 理解均有提升。
- 定价:年底前 API 调用价较上一代 3.6 Flash 便宜 50%;已上线 API、AI Studio、Antigravity,接入 Google AI Pro/Ultra 订阅,并开始集成至 GitHub Copilot。开发者实测其在 agent 工作流中"先探索、解析错误、跑测试,最后才改代码",减少无效轮次;Google 还演示了 3 个 agent 自主从零训练机器人控制模型。
- 值得关注原因:Google 把"编码/agent 专用 + 成本减半"作为竞争主轴——模型迭代从 3.5 到 3.7 仅约 3 个月、距 3.6 仅三周,工程迭代极快;价格腰斩进一步压低企业级 agent 开发门槛。需关注两点:一是旗舰 Gemini 3.5 Pro 仍延期,市场担忧其 AI 路线图执行力;二是"Flash 打性价比、Pro 缺席"的错位,给闭源前沿模型留出窗口。对开发者,Copilot 接入后多模型 harness 价值再被放大。
- 来源:AGI Hunt · Gemini 3.7 Flash 降 50% · 格隆汇 · 旗舰仍延期
4. 第二届世界人形机器人运动会 8/22 北京开幕:2056 台机器人同台"上岗"
- 事件内容:
- 第二届世界人形机器人运动会进入倒计时,8 月 22 日将在国家速滑馆"冰丝带"开幕,正赛 8/22–26 举行。赛事吸引六大洲 16 国 666 支队伍、2056 台机器人同台竞技,队伍数较首届大增 138%、机器人数量翻两番;其中国内 157 家企业、200 所院校与科研机构的 641 支队伍、1975 台机器人到场,27 所 985 高校参与。
- 赛项从首届 26 项扩容至 51 项(竞技 30 + 场景 21),5 天 9 单元 1301 场比赛;新增跳远、举重、拔河、乒乓球等极限考验,场景赛延伸进工业、酒店、家庭、物流真实环境,并设灵巧手赛项(粉末称量、镊子夹豆、开瓶撬盖)。组委会称"得了奖牌就拿订单,出了赛场就进现场"。
- 值得关注原因:这是具身智能"竞技场→真实场景"转化的年度窗口——规模与国际化程度翻倍、赛项直接对标"乏、脏、险、难"人类工作,等于把真实环境交互能力当硬指标考核。对行业,赛事成为技术验证与商业订单的对接平台(场景赛即订单赛);对投资人,可据此观察第一梯队本体/小脑/灵巧手的真实水平。需关注 8 月"机器人超级月"其他催化(WRC 8/19、比亚迪人形等)。
- 来源:新浪财经 · 全球人形机器人将齐聚北京打擂
5. 戴盟发布 Daimon-TWM 触觉锚定世界模型,蚂蚁领投数亿融资
- 事件内容:
- 具身公司 戴盟机器人近期发布触觉锚定世界模型 Daimon-TWM,定位"物理交互脑",强调驱动灵巧操作。其核心理念是把触觉当作判断物理世界的"最终证据"——当摄像头看起来插头已对准、但手指受力显示顶歪时,模型以触觉为准推翻视觉判断并调整动作(VTLA 架构,2024 年提出触觉与视觉同等重要)。
- 模型发布次日,戴盟官宣获蚂蚁集团领投的数亿元融资——这是蚂蚁在触觉方向的首次出手。蚂蚁系此前已投宇树、星海图、灵心巧手等具身企业,触觉拼图补齐。行业背景:6 月李飞飞/Jim Fan 的 T-Rex 用触觉灵巧手显著提升成功率;蚂蚁/浙大/港大论文显示真机工业装配中,加触觉的 Tactile-WAM 成功率 51%,较纯视觉 WAM 的 18% 提升 33 个百分点。
- 值得关注原因:触觉正成为 2026 具身智能的关键技术分水岭——从"看得见"到"摸得准",解决了视觉在接触力、形变、滑移上的盲区。戴盟获蚂蚁领投、高盛报告将其列为唯一视触觉企业,说明资本与智库同时下注"触觉锚定世界模型"路线。对行业,灵巧手 + 触觉传感器 + 触觉世界模型将成下一轮差异化竞争点;对本体厂,需尽早规划触觉数据闭环。
- 来源:网易 · 戴盟 Daimon-TWM 与蚂蚁融资
