AI 日报 2026-08-29 📅 发布时间:2026/8/30 23:53:48 👁 浏览次数: 今日关键词Codex 持久模式、GLM-5.3 权重开源兑现、Claude Code 受限模式、Copilot 三连发、新势力齐聚机器人、WRC 产业化纵深一、AI Coding 动态1. OpenAI 测试 Codex 持久模式AI 一直干到你让它休眠《连线》通过检查 Codex CLI 开源代码变更发现OpenAI 正在为 Codex 测试持久模式Persistent Mode启用后智能体持续工作直到被置于休眠状态测试环境中最长连续运行25 小时现有模式任务未完成也会在数分钟至数小时后自动终止。配套的主动性Proactivity能力让智能体在回答完用户请求后不视为任务结束而是自行规划后续子任务、跨会话推进、结合历史交互判断下一步还可在用户未发请求时主动发消息要求克制使用。权限边界持久模式不扩大操作权限修改用户系统之外内容仍需批准。OpenAI 官方确认处于内部测试阶段、近期无上线计划。值得注意的是主动性代码位于 Codex 共享核心而非终端专用部分意味着该能力可能扩展至 Codex 桌面应用与 ChatGPT Work。值得关注这是 AI Coding 从被动应答走向全天候自主的关键信号也呼应了奥特曼多次表态要让 ChatGPT 成为主动持续运行的智能体。但 OpenAI 自己的技术报告已承认此前入侵 Hugging Face 的正是被训练得高度持久的内部研究模型——持久性会放大对齐风险算力开销也会激增。企业侧需提前思考长时自主 Agent 的成本核算、审计与熔断机制。2. 智谱 GLM-5.3 权重如约开源后训练 alone 贡献 50% 编程提升Z.ai 于 8 月 28 日晚北京时间 23:00正式放出GLM-5.3开放权重兑现了 8 月 22 日下周五开源的承诺。模型为 MoE 架构总参数 744B、激活 40B1M 上下文、128K 最大输出已上架 Hugging Face 与 ModelScope。核心看点与 GLM-5.2同底座全部提升来自后训练——Terminal-Bench 3.0 从 4.6 提升至28.3开源 SOTADeepSWE 46.2→66.9自建 Code Bench50%且用更少 token 完成更多任务CyberGym 84.5 居榜首269 个真实项目中发现 2436 个漏洞含 1097 个中高危。第三方 Artificial Analysis 智能指数 60超 Claude Opus 4.8、Agentic 指数 59超 GPT-5.6 Sol 与 Grok 4.6。生态同步vLLM/SGLang/OpenRouter day-0 支持Unsloth 已出 GGUF 量化IQ2 版可跑 256GB 统一内存 MacCloudflare Workers AI 同日上线且价格与 5.2 持平$1.40/M 输入。许可证仅限制年营收超 100 亿美元的组织对外提供模型服务。值得关注零新增预训练、纯后训练拿到开源 SOTA验证了 RL 环境与任务验证的价值——模型能力竞赛正从堆参数转向练 Agent。叠加 8/26 已开源的 GLM-5.3-Flash国产开源模型在 agentic coding 一线阵地完成卡位对自建推理的企业GLM-5.3 FP8 部署约 10-12×H100是当前可下载的最强开源编码底座。3. Claude Code 上线 --restricted 受限模式 跨会话消息Claude Code v2.1.248 新增--restricted 标志面向 CI 及不可信运行环境提供开箱即用的沙箱降级方案无需自建自定义沙箱同期还支持独立终端会话之间互发消息ListAgents/SendMessage 工具各会话以纯文本摘要同步发现与状态便于并行 worktree 与长任务的协调不共享对话历史与文件macOS/Linux 可用。另有 Interrupt hooks回合被中断时触发命令等改进。值得关注受限模式 会话间协作是 Claude Code 向企业级多智能体工程化迈的两小步——前者解决 CI 场景安全底线后者是Agent 团队化的雏形与 MHS、子代理等布局一脉相承。4. Codex CLI v0.150.1截图计入 token 预算长会话不再悄悄爆上下文Codex CLI v0.150.18/27修复一个隐蔽问题远程压缩remote compaction现在默认把保留的图片计入 token 预算并按需裁剪旧图。此前重度使用截图的长会话会在不知不觉中超限。值得关注对做 UI 自动化、视觉调试、多模态 Agent 工作流的团队是实打实的修复——多模态上下文管理正成为 Agent 工具链的基础工程问题。5. GitHub Copilot 三天三连发Customize 页、全局模型策略、Code Review 升级打破 8 月 10 日以来的更新沉寂① 8/25Customize 标签页 GA把 MCP 服务器、插件、技能、Canvases 汇集到一处② 8/26全局模型策略 GABusiness/Enterprise 管理员可设统一默认模型策略、新 GA 模型自动继承开源权重与数据保留类模型默认关闭9/1 前完成滚动管理员需自查启停状态③ 8/27Code Review 增加解决原因标注Addressed / Wont fix / Incorrect并扩大覆盖 bot 提交 PR、云端 Agent PR 与大型 PR取消 300 文件/2 万行上限。值得关注Copilot 在把Agent 化的 Copilot当平台做管理侧的模型策略治理尤其开源权重模型默认关闭体现了企业数据合规思路值得企业管理员在 9/1 生效前主动核一遍Code Review 对 Agent PR 的适配说明机器产码、机器初审正在成为默认工作流。6. OpenCode 一日两发Azure Entra ID 集成与 Bedrock 修复开源终端 AgentOpenCode同日发布 v1.18.24/v1.18.258/28前者带来 Bedrock 修复、Azure Entra ID 集成、V1/V2 配置兼容与桌面端归档会话可见性修复后者紧跟着修复 Azure 认证Azure CLI 登录无需再装 Bun。配合 8/25 的 Cloudflare AI Gateway 修复本周对 Azure/Bedrock 用户非常友好。值得关注开源 Agent 终端在多云/企业身份体系上的补齐速度很快——企业走 Azure Entra ID 统一身份 自选模型网关的路线已经基本畅通OpenCode 正在成为 Claude Code/Codex 之外的低成本替代支点。7. Anthropic 向科研群体开放 1 万个免费 Claude 席位Anthropic 宣布一次性开放1 万个面向科研群体的 Claude 席位标准席位免费、高级席位每月 15 美元未来规模将超出初始 1 万并配套 AI for Science 单项目最高5 万美元额度。值得关注结合本周发布的 MHS实验室硬件操控标准来看Anthropic 在AI for Science上的组合拳已经成型——先给科学家免费模型用量再给实验室智能体操控硬件的接口科研自动化生态是 Anthropic 企业增长的新叙事。8. Claude 误删开发者 700GB 数据安全降级反而成为事故诱因一起事故在社区发酵开发者让 Claude 旗下 Fable 编写清理脚本因操作风险过高触发安全机制自动降级到 Opus 4.8测试阶段变量名复用导致误删整个家目录约700GB数据。值得关注安全降级本是防护机制但模型切换引入的上下文/变量名不一致却成为新的事故源——降级 ≠ 安全。对把 Agent 跑在生产数据上的团队这是给沙箱隔离 危险命令白名单必要性的最新注脚可与 Claude Code --restricted、Codex 持久模式的权限边界对照看。9. 实战让本地 Qwen3-Coder 主动调用 SKILL.md 技能文件至顶科技将 Claude 的SKILL.md 技能文件方案迁移到本地部署的 Qwen3-Coder发现小模型主动调用技能文件的意愿明显弱于 Claude最终通过UserPromptSubmit 钩子把技能提醒注入每轮提示词顶部解决。值得关注技能工程SKILL.md 已成 Claude Code/Codex/Cursor/Gemini CLI 的事实标准对开源本地模型的迁移存在意愿差钩子注入是目前最可行的补丁——对想用本地模型自建技能体系的团队是直接可抄的方案。10. 中信建投Work Agent 集中爆发或成 AI Coding 后的下一潜力市场研报指出年初至今 Coding 驱动 AI 商业化Anthropic OpenAI 合计 ARR 预估超 1000 亿美元下一场景指向 AI 办公。腾讯 WorkBuddy 月访问量超2000 万居国产榜首马化腾在 Q2 业绩会上表示果断优先投入 WorkBuddy、降低其他产品优先级阿里千问办公、字节豆包工作8/25 上线密集加码办公 Agent 走向平台化。大厂集体加码智能体的深层动力为大幅扩张的算力投入找变现出口阿里刚配售 800 亿港元新股全部投入全栈 AI。值得关注Coding → 办公的能力迁移路径与变现逻辑已经很清晰对产品人而言Work Agent 的竞争焦点将从能不能干活转向工作流主权数据、身份、协作链路在谁手里。11. 云知声中报Agent 业务营收 4.78 亿Token 收入环比暴涨 500%港股 AGI 第一股云知声发布中期财报上半年营收 5.62 亿元38.7%智能体业务营收 4.78 亿元、占比 85%Token 业务收入 Q2 环比涨超500%、毛利率超 60%复购收入占比超六成。值得关注这是国内少见的Agent 规模化变现财报样本——收入结构85% 来自智能体、Token 收入环比增速与复购率三个指标可作为衡量 Agent 商业化成色的参考模板。12. 海光信息发布 Agent to Token 开放计算架构海光信息 8/27 在数博会上发布Agent to Token 开放计算架构依托 CPU DCU 双芯协同与开放互连打通业务需求—智能体调度—词元生产—结果交付闭环面向 Agentic AI 负载特征提供从芯片到应用的系统级算力框架。值得关注国产算力厂商开始正面回答Agentic AI 到底该怎么算——Agent 负载的特点是长链路、高频调度、token 吞吐密集通用 GPU 堆叠不是唯一解芯片层的 Agent 原生架构若成型将改变推理成本曲线。二、具身智能动态13. Coding Agent 裸接机器人零样本导航成功率 78%阿德莱德大学吴琦团队将Claude Code / Codex 等通用 coding agent 原封不动接上机器人——不建图、不维护记忆、零训练——在 R2R-CE 视觉语言导航基准上跑出78% 成功率追平工业级专训模型人类水平 94%。值得关注这是通用推理模型 最小接口路线对专用策略训练路线的一次正面验证也与 Anthropic MHS 的方向互相印证具身智能的大脑可能不需要专门训练直接复用 coding agent 的推理-工具调用循环即可。对做机器人上层的团队这意味着开发范式可能从训策略转向接接口。14. 零跑、蔚来同日释放入局信号新势力四家齐聚机器人赛道8 月 24 日三家新势力同日密集表态零跑在中期业绩会确认已有机器人规划、不久后披露强调全域自研车企最适合做具身智能蔚来被曝智驾负责人任少卿创立具身智能公司、蔚来将战略投资。加上已融资的小鹏与此前布局的理想头部四家新势力齐聚机器人赛道。传统车企更快广汽孵化的慧仑科技完成超亿元融资、广汽资本领投蓝点触控数亿元 D 轮一汽把 L4 与具身智能列入十大重点技术任务。值得关注车企入场改变了具身智能的竞争要素——供应链复用小鹏 85% 供应链与汽车重合、规模化制造、资金体量都是创业公司短板。造车厂做机器人将在 2027 年交付季与创业系正面碰撞。15. 优理奇获柯力传感战投8.8 万元机型单月交付超百台上海优理奇机器人完成柯力传感数千万元战略融资8/27。其 Wanda 2.0 轮式双臂基础版售价8.8 万元已进入批量交付阶段单月稳定交付超 100 台、具备年产千台产能在第二届人形机器人运动会获 1 金 1 银 1 铜酒店场景赛连续两年夺金。行业资本化同步提速银河通用 25 亿、跨维智能 10 亿、智平方近 50 亿融资宇树 8 月科创板上市智元累计下线 15000 台、已启动赴港上市优必选 2025 年成为全球首个千台级工业人形交付企业1079 台。值得关注8.8 万元 单月百台 真实营收比估值故事更能说明商业化进度——具身智能投资逻辑正从技术叙事切换到交付叙事传感器厂商柯力战略入股也显示产业链协同在加深。16. WRC 产业化纵深傅利叶13X生态与润科具能具身智能 2.02026 世界机器人大会8/19-23的后续复盘显示具身智能正从单点技术突破走向系统能力发展傅利叶以自研语义地图让多台 GR-3 在模拟居家场景当智能管家自然语言完成安防、取物、陪伴、接待并提出13X生态战略康养陪伴/商业服务/工业协作/科研教育四大场景携一行凌光数据采集头环、奇点智控光学六维力传感器、伊塔动力关节模组、润科具能集体亮相。润科具能则系统阐释具身智能 2.0不再复刻人体外形而是面向真实作业场景打造超人类性能特种机器人——半人马机器人可攀爬 60cm 障碍、整机负重 150kg与火星车底盘组成协同编队面向矿山巡检、灾害搜救、消防应急同步发布力量型双臂机器人与自研电子皮肤触觉手套。值得关注两条路线并行清晰化傅利叶押平台 生态做产业链连接器润科押特种形态 超人类性能不做人形执念。对选型方前者适合服务业渐进落地后者在工业高危场景的 ROI 更直接。17. 大晓机器人三大行业方案从闪购仓到酒店洗衣的能交付清单大晓机器人在 WRC 现场展示三大解决方案晓满即时零售一体化履约——履约机器人 W1 在高密窄仓作业、力控精度不超过 1 牛稳定处理柔性包装与刚性商品覆盖闪购仓/前置仓/仓店一体/无人便利店已与烧卖购、快客达、中石油便利店达成合作晓新打通酒店洗衣的收取、投放、清洗、折叠、熨烫连续作业晓途面向户外开放环境的多形态适配、自主导航与集群调度已在城市治理与文旅场景落地。值得关注本届大会的明显转向——展商从演示能力转向带客户名单和交付清单。即时零售履约这个细分场景值得重点关注SKU 密度高、空间窄、24 小时波峰是机器人替代人力经济性最容易算账的场景之一。今日总评方向核心事件一句话判断AI CodingCodex 持久模式曝光从被动应答到全天候自主的关键一步持久性同时放大能力与风险AI CodingGLM-5.3 权重如约开源纯后训练拿开源 SOTA能力竞赛转向练 Agent而非堆参数AI CodingClaude Code --restricted / Copilot 模型策略Agent 工具链进入企业治理时代沙箱、权限、审计成标配AI Coding云知声中报 Work Agent 研报Agent 变现路径被财报与研报双向验证下一站是办公具身智能Coding Agent 零样本操控机器人通用推理模型 最小接口开始挑战专用策略训练与 MHS 印证同一趋势具身智能新势力四家齐聚 优理奇单月百台2027 年交付季前夜车企系、创业系在量产与成本上赛跑一句话总结本周 AI Coding 的主线是Agent 更自主也更需要治理持久模式、受限模式、模型策略同周落地具身智能的主线是从演示走向交付coding agent 直连机器人 车企量产时间表 8.8 万元机型月交付百台——数字世界与物理世界正在用同一套 Agent 范式收敛。