2026-08-21 · Harness 破 16 万星、会话可 fork,小米人形首秀
2026年8月21日阅读时长约 1 分钟
8/21 主线:AI Coding——DeepSeek Harness rc.8 多模态/子代理/Windows PTY 上线、6 天破 16.7 万星,Codex 会话可 fork/export、Claude Code 安全固化;具身——小米全尺寸人形 WRC 首秀、银河「一脑多能」+ 亦庄全国首个具身演出沙盒审批。
1. DeepSeek Harness 生态加速:rc.8 多模态·子代理·Windows PTY,6 天破 16.7 万星
- 事件内容:
- 8 月 13 日开源、MIT 协议的 DeepSeek Harness(dsh)在 8 月 19 日发布 v0.1.0-rc.8,三条主线集中迭代:多模态——DeepSeek 模型适配器开放原生图片请求,
/goal、/plan等核心命令首次支持图文混合输入;子代理管理——Claude Code 与 Codex 的子代理升级为「可按需安装的 Profile Bundle」,跨生态复用 Agent 配置;Windows 兼容性——PTY 终端引入持久 PowerShell 会话。 - 同期 SQLite 后端完成读写性能与存储体积双重优化。截至 8/20 报道,仓库累计 167,547 颗 Star、17,896 个 Fork,开源 6 天即创开发者工具类项目增速纪录之一;社区已有 288+ 个
dsh-plugin第三方插件。
- 8 月 13 日开源、MIT 协议的 DeepSeek Harness(dsh)在 8 月 19 日发布 v0.1.0-rc.8,三条主线集中迭代:多模态——DeepSeek 模型适配器开放原生图片请求,
- 值得关注原因:这是「模型之上、Harness 之下」开发者入口争夺的又一标志性节点。rc.8 的方向很明确——把「多模态任务输入」「子代理编排」「跨平台执行」三件 Agent 工程里最硬的事,做成开箱即用的插件能力。结合我们长期跟踪的 harness 主线(RepoMod-Bench、SIGIL 等),DeepSeek 正在用「一切皆插件 + 可回滚副作用」的 Cordis 架构,把 Claude Code / Codex 的闭源工程经验开源化、乐高化。对团队,值得关注的是:同一套插件能否真正跨模型/跨 Agent 复用,以及「运行中改写自己」带来的长期自治风险。需关注:文档与存储格式仍在快速变更(rc.8 存储不向下兼容),生产落地需谨慎。
- 来源:CSDN《DeepSeek Harness v0.1.0-rc.8 更新:多模态、子代理、Windows PTY》8/20 · 网易《150K Star 之后,DeepSeek Harness 给 AI 编程带来了什么?》8/20
2. 代码托管与「会话即工程线程」:Cursor 托管代码、Codex 让 Agent 会话可 fork/export
- 事件内容:
- OpenAI Codex CLI 0.148.0(8/18)把「长程 Agent 会话」当作真正的工程对象来治理:新增
/export把完整 TUI 对话导出为 Markdown;codex exec fork可从旧会话派生新分支,resume选择器支持归档与恢复过往会话;符合条件的工作区在/status与状态栏看到线程级用量;并新增 Amazon Bedrock Runtime 作为内置模型供应商,hooks 支持异步命令执行与 MCP 工具调用。 - 这与此前 Cursor 推出 Origin(面向 Agent 的代码托管平台,堆叠式 PR 解决多 Agent 高频提交冲突)形成呼应:AI coding 的竞争正从「编辑器里的补全循环」上移到「代码托管 + 会话治理」的基础设施层。
- OpenAI Codex CLI 0.148.0(8/18)把「长程 Agent 会话」当作真正的工程对象来治理:新增
- 值得关注原因:两个信号指向同一结论——当 Agent 成为 PR 的主要生产方,「仓库」和「会话」都不再是给人设计的旧抽象,必须重做。Codex 的 fork/archive/resume 模型意味着:一个 agent 对话可以被当成「可分支、可恢复的工程线程」,而非一次性请求;Cursor 托管代码则意味着「开发全栈入口」之争开启。对团队,需提前想清楚:Agent 会话的归属、审计与知识沉淀(谁拥有这条线程?能否回放?);对竞品,闭源 harness 若不开放会话/技能的可移植格式,将被「技能可跨工具复用」的生态甩开。需关注:Origin 是否开放对接非 Cursor Agent、Codex Bedrock 模式下的数据合规。
- 来源:Oday Bakkour《AI Coding News: August 19, 2026 — Cursor Origin, Codex Forking》
3. 安全与长会话可靠性:Claude Code 补完 NTLM 泄漏、Cursor builds 让 Agent 3x 快启动
- 事件内容:
- Claude Code 在 8/18 连续发布 v2.1.234 / v2.1.235:v2.1.234 关闭了最后一个 Windows NTLM 路径泄漏缺口(此前该问题耗时两版才在所有预批准文件访问路径上补全);v2.1.235 转向质量修复——长会话 compact 后自动模式重复拒拦沙箱命令网络访问的问题被修、会话级权限答案(含拒绝)在后台子代理提示时不再丢失、密钥/bearer token 回显遮蔽持续加固,并加入可选拼写检查。
- 同期 Cursor 在 8/13 推出 Cloud Agent「Builds」:预先克隆仓库、装好依赖的开发环境,让 Agent 首次 token 提前约 3 倍;环境损坏时回退到上次成功构建,Builds 标签页显示构建状态与所用 commit,且随 Cloud Agents 免费提供。
- 值得关注原因:两条更新共同印证——AI coding 的下一护城河不是「更会写代码」,而是「更可靠地跑起来」。Claude Code 的 NTLM 补丁用了两个版本才彻底收口,提醒组织:CLI 工具必须保持自动更新,不能把上周的补丁当终局;权限/凭证在长会话与多子代理场景下的「掉线」才是真实风险点。Cursor builds 则攻击「Agent 规模化运行成本与启动延迟」——用预热环境把等待压到三分之一。对团队,结论清晰:选型时把「安全模型 + 长会话可靠性 + 启动/运行成本」与「代码能力」并列评估。需关注:各家在「少打断 vs 强审批」之间的取舍分化。
- 来源:Oday Bakkour《AI Coding News: August 18, 2026 — Claude Code NTLM, Cursor 3x Builds》
4. 小米新一代全尺寸人形机器人 WRC 首秀:66 自由度、工厂实训 4 月成功率 98%
- 事件内容:
- 8/19–8/21 世界机器人大会,小米新一代全尺寸人形机器人(完整版)首次线下公开亮相:身高约 1.70 米、体重 66 公斤、全身 66 个关节自由度(手部 33 个,较 2022 初代 CyberOne 的 21 自由度提升 3 倍),单手 21 自由度、0.5ms 响应、8200mm² 触觉传感(感知 0.1N)。
- 搭载自研 Xiaomi-Robotics-0 视觉-语言-动作基座模型(4.7B,基于 2 亿步运动轨迹 + 8000 万条多模态样本),已在小米汽车工厂「实习」4 个月:自攻螺母上件成功率从 90.2% 升至 98%(熟练工人约 99%,预计年底持平),连续作业 3 小时、匹配 76 秒产线节拍,并升级为多机协同。量产路线:2026 年底小规模商用、工厂部署超 2000 台,2030 年后家庭版成本降至万元级。
- 值得关注原因:小米给出了「自家工厂炼自家机器人」的务实范式——产线真实问题直接转化为训练数据,形成高效迭代飞轮,且明确「不做花架子、先工业后家庭」。66 自由度 + 高成功率 + 明确万台级部署时间表,把人形机器人从「样机炫技」推向「可排产的工具」。对产业,这标志着车企/消费电子巨头把成熟的制造与供应链基因注入具身赛道,量产节奏从「概念」转向「产线工时与良率」。需关注:98% 是否能在多工位、长周期稳定复现,以及万元级家庭版的成本工程可行性。
- 来源:新浪《小米人形机器人完整版亮相:身高1.7米66自由度,已进厂实训4个月》8/21 · 北京日报/今日头条《北京机器人组团亮功夫》8/21
5. 具身「大脑」架构升级 + 监管破冰:银河「一脑多能」、亦庄全国首个具身演出沙盒审批
- 事件内容:
- 技术侧:银河通用在 WRC 首发双足人形「银河星仔」,背后是具身大模型 **「银河星脑」**的进化——主打「一脑多能」:同一通用大脑统一理解任务、统一规划行动,把完整智能注入双足、轮式、重载等不同本体(GalbotG1 / S1 / ET1),打破行业「一机一模型、一场景一技能」的孤岛。北京通用人工智能研究院的「通小宇」则把虚拟通用智能体「通通」的认知架构完整迁移到物理机器人,实现感知-认知-决策-行动一体化。
- 监管侧:8/20 北京经开区(亦庄)在 WRC 现场颁发全国首批 具身机器人演出「沙盒审批」准入证明,并上线全国首个机器人沙盒审批全流程管理系统,为 3 家企业(情感交互表演、器乐合奏、编队舞蹈三类演艺形态)划定「入盒申请—符合性审查—沙盒试验—过程监督—出盒审批」的安全试错空间。这是继数字人演出之后,新业态审批监管的开创性延伸。
- 值得关注原因:一破一立,勾勒出具身智能落地的两块关键拼图。架构上,「一脑多能」意味着模型迭代成本被摊薄到多本体、多场景,谁先跑通「通用大脑 + 数据飞轮」谁就掌握飞轮;监管上,亦庄的沙盒审批首次为「机器人进公共/演艺空间」提供了合规路径,把「想发展无路径、想创新无规则」的困境制度化破题。这对其他城市与园区是可直接抄的招商/治理样板。需关注:沙盒审批的「出盒」硬指标如何定、跨城互认能否打通;「一脑多能」在真实长尾场景的泛化上限。
- 来源:央广网/腾讯《全国首个具身机器人演出「沙盒审批」试点落地北京经开区》8/21 · 北京日报/今日头条《北京机器人组团亮功夫》(银河星脑、通小宇)8/21 · 新华每日电讯/云南网《从「炫技」到「实干」机器人走向更多真实场景》8/21
