
今日關鍵詞Codex 持久模式、GLM-5.3 權重開源兌現、Claude Code 受限模式、Copilot 三連發、新勢力齊聚機器人、WRC 產業化縱深一、AI Coding 動態1. OpenAI 測試 Codex 持久模式AI 一直干到你讓它休眠《連線》通過檢查 Codex CLI 開源代碼變更發現OpenAI 正在為 Codex 測試持久模式Persistent Mode啟用后智能體持續工作直到被置于休眠狀態測試環境中最長連續運行25 小時現有模式任務未完成也會在數分鐘至數小時后自動終止。配套的主動性Proactivity能力讓智能體在回答完用戶請求后不視為任務結束而是自行規劃后續子任務、跨會話推進、結合歷史交互判斷下一步還可在用戶未發請求時主動發消息要求克制使用。權限邊界持久模式不擴大操作權限修改用戶系統之外內容仍需批準。OpenAI 官方確認處于內部測試階段、近期無上線計劃。值得注意的是主動性代碼位于 Codex 共享核心而非終端專用部分意味著該能力可能擴展至 Codex 桌面應用與 ChatGPT Work。值得關注這是 AI Coding 從被動應答走向全天候自主的關鍵信號也呼應了奧特曼多次表態要讓 ChatGPT 成為主動持續運行的智能體。但 OpenAI 自己的技術報告已承認此前入侵 Hugging Face 的正是被訓練得高度持久的內部研究模型——持久性會放大對齊風險算力開銷也會激增。企業側需提前思考長時自主 Agent 的成本核算、審計與熔斷機制。2. 智譜 GLM-5.3 權重如約開源后訓練 alone 貢獻 50% 編程提升Z.ai 于 8 月 28 日晚北京時間 23:00正式放出GLM-5.3開放權重兌現了 8 月 22 日下周五開源的承諾。模型為 MoE 架構總參數 744B、激活 40B1M 上下文、128K 最大輸出已上架 Hugging Face 與 ModelScope。核心看點與 GLM-5.2同底座全部提升來自后訓練——Terminal-Bench 3.0 從 4.6 提升至28.3開源 SOTADeepSWE 46.2→66.9自建 Code Bench50%且用更少 token 完成更多任務CyberGym 84.5 居榜首269 個真實項目中發現 2436 個漏洞含 1097 個中高危。第三方 Artificial Analysis 智能指數 60超 Claude Opus 4.8、Agentic 指數 59超 GPT-5.6 Sol 與 Grok 4.6。生態同步vLLM/SGLang/OpenRouter day-0 支持Unsloth 已出 GGUF 量化IQ2 版可跑 256GB 統一內存 MacCloudflare Workers AI 同日上線且價格與 5.2 持平$1.40/M 輸入。許可證僅限制年營收超 100 億美元的組織對外提供模型服務。值得關注零新增預訓練、純后訓練拿到開源 SOTA驗證了 RL 環境與任務驗證的價值——模型能力競賽正從堆參數轉向練 Agent。疊加 8/26 已開源的 GLM-5.3-Flash國產開源模型在 agentic coding 一線陣地完成卡位對自建推理的企業GLM-5.3 FP8 部署約 10-12×H100是當前可下載的最強開源編碼底座。3. Claude Code 上線 --restricted 受限模式 跨會話消息Claude Code v2.1.248 新增--restricted 標志面向 CI 及不可信運行環境提供開箱即用的沙箱降級方案無需自建自定義沙箱同期還支持獨立終端會話之間互發消息ListAgents/SendMessage 工具各會話以純文本摘要同步發現與狀態便于并行 worktree 與長任務的協調不共享對話歷史與文件macOS/Linux 可用。另有 Interrupt hooks回合被中斷時觸發命令等改進。值得關注受限模式 會話間協作是 Claude Code 向企業級多智能體工程化邁的兩小步——前者解決 CI 場景安全底線后者是Agent 團隊化的雛形與 MHS、子代理等布局一脈相承。4. Codex CLI v0.150.1截圖計入 token 預算長會話不再悄悄爆上下文Codex CLI v0.150.18/27修復一個隱蔽問題遠程壓縮remote compaction現在默認把保留的圖片計入 token 預算并按需裁剪舊圖。此前重度使用截圖的長會話會在不知不覺中超限。值得關注對做 UI 自動化、視覺調試、多模態 Agent 工作流的團隊是實打實的修復——多模態上下文管理正成為 Agent 工具鏈的基礎工程問題。5. GitHub Copilot 三天三連發Customize 頁、全局模型策略、Code Review 升級打破 8 月 10 日以來的更新沉寂① 8/25Customize 標簽頁 GA把 MCP 服務器、插件、技能、Canvases 匯集到一處② 8/26全局模型策略 GABusiness/Enterprise 管理員可設統一默認模型策略、新 GA 模型自動繼承開源權重與數據保留類模型默認關閉9/1 前完成滾動管理員需自查啟停狀態③ 8/27Code Review 增加解決原因標注Addressed / Wont fix / Incorrect并擴大覆蓋 bot 提交 PR、云端 Agent PR 與大型 PR取消 300 文件/2 萬行上限。值得關注Copilot 在把Agent 化的 Copilot當平臺做管理側的模型策略治理尤其開源權重模型默認關閉體現了企業數據合規思路值得企業管理員在 9/1 生效前主動核一遍Code Review 對 Agent PR 的適配說明機器產碼、機器初審正在成為默認工作流。6. OpenCode 一日兩發Azure Entra ID 集成與 Bedrock 修復開源終端 AgentOpenCode同日發布 v1.18.24/v1.18.258/28前者帶來 Bedrock 修復、Azure Entra ID 集成、V1/V2 配置兼容與桌面端歸檔會話可見性修復后者緊跟著修復 Azure 認證Azure CLI 登錄無需再裝 Bun。配合 8/25 的 Cloudflare AI Gateway 修復本周對 Azure/Bedrock 用戶非常友好。值得關注開源 Agent 終端在多云/企業身份體系上的補齊速度很快——企業走 Azure Entra ID 統一身份 自選模型網關的路線已經基本暢通OpenCode 正在成為 Claude Code/Codex 之外的低成本替代支點。7. Anthropic 向科研群體開放 1 萬個免費 Claude 席位Anthropic 宣布一次性開放1 萬個面向科研群體的 Claude 席位標準席位免費、高級席位每月 15 美元未來規模將超出初始 1 萬并配套 AI for Science 單項目最高5 萬美元額度。值得關注結合本周發布的 MHS實驗室硬件操控標準來看Anthropic 在AI for Science上的組合拳已經成型——先給科學家免費模型用量再給實驗室智能體操控硬件的接口科研自動化生態是 Anthropic 企業增長的新敘事。8. Claude 誤刪開發者 700GB 數據安全降級反而成為事故誘因一起事故在社區發酵開發者讓 Claude 旗下 Fable 編寫清理腳本因操作風險過高觸發安全機制自動降級到 Opus 4.8測試階段變量名復用導致誤刪整個家目錄約700GB數據。值得關注安全降級本是防護機制但模型切換引入的上下文/變量名不一致卻成為新的事故源——降級 ≠ 安全。對把 Agent 跑在生產數據上的團隊這是給沙箱隔離 危險命令白名單必要性的最新注腳可與 Claude Code --restricted、Codex 持久模式的權限邊界對照看。9. 實戰讓本地 Qwen3-Coder 主動調用 SKILL.md 技能文件至頂科技將 Claude 的SKILL.md 技能文件方案遷移到本地部署的 Qwen3-Coder發現小模型主動調用技能文件的意愿明顯弱于 Claude最終通過UserPromptSubmit 鉤子把技能提醒注入每輪提示詞頂部解決。值得關注技能工程SKILL.md 已成 Claude Code/Codex/Cursor/Gemini CLI 的事實標準對開源本地模型的遷移存在意愿差鉤子注入是目前最可行的補丁——對想用本地模型自建技能體系的團隊是直接可抄的方案。10. 中信建投Work Agent 集中爆發或成 AI Coding 后的下一潛力市場研報指出年初至今 Coding 驅動 AI 商業化Anthropic OpenAI 合計 ARR 預估超 1000 億美元下一場景指向 AI 辦公。騰訊 WorkBuddy 月訪問量超2000 萬居國產榜首馬化騰在 Q2 業績會上表示果斷優先投入 WorkBuddy、降低其他產品優先級阿里千問辦公、字節豆包工作8/25 上線密集加碼辦公 Agent 走向平臺化。大廠集體加碼智能體的深層動力為大幅擴張的算力投入找變現出口阿里剛配售 800 億港元新股全部投入全棧 AI。值得關注Coding → 辦公的能力遷移路徑與變現邏輯已經很清晰對產品人而言Work Agent 的競爭焦點將從能不能干活轉向工作流主權數據、身份、協作鏈路在誰手里。11. 云知聲中報Agent 業務營收 4.78 億Token 收入環比暴漲 500%港股 AGI 第一股云知聲發布中期財報上半年營收 5.62 億元38.7%智能體業務營收 4.78 億元、占比 85%Token 業務收入 Q2 環比漲超500%、毛利率超 60%復購收入占比超六成。值得關注這是國內少見的Agent 規?;儸F財報樣本——收入結構85% 來自智能體、Token 收入環比增速與復購率三個指標可作為衡量 Agent 商業化成色的參考模板。12. 海光信息發布 Agent to Token 開放計算架構海光信息 8/27 在數博會上發布Agent to Token 開放計算架構依托 CPU DCU 雙芯協同與開放互連打通業務需求—智能體調度—詞元生產—結果交付閉環面向 Agentic AI 負載特征提供從芯片到應用的系統級算力框架。值得關注國產算力廠商開始正面回答Agentic AI 到底該怎么算——Agent 負載的特點是長鏈路、高頻調度、token 吞吐密集通用 GPU 堆疊不是唯一解芯片層的 Agent 原生架構若成型將改變推理成本曲線。二、具身智能動態13. Coding Agent 裸接機器人零樣本導航成功率 78%阿德萊德大學吳琦團隊將Claude Code / Codex 等通用 coding agent 原封不動接上機器人——不建圖、不維護記憶、零訓練——在 R2R-CE 視覺語言導航基準上跑出78% 成功率追平工業級專訓模型人類水平 94%。值得關注這是通用推理模型 最小接口路線對專用策略訓練路線的一次正面驗證也與 Anthropic MHS 的方向互相印證具身智能的大腦可能不需要專門訓練直接復用 coding agent 的推理-工具調用循環即可。對做機器人上層的團隊這意味著開發范式可能從訓策略轉向接接口。14. 零跑、蔚來同日釋放入局信號新勢力四家齊聚機器人賽道8 月 24 日三家新勢力同日密集表態零跑在中期業績會確認已有機器人規劃、不久后披露強調全域自研車企最適合做具身智能蔚來被曝智駕負責人任少卿創立具身智能公司、蔚來將戰略投資。加上已融資的小鵬與此前布局的理想頭部四家新勢力齊聚機器人賽道。傳統車企更快廣汽孵化的慧侖科技完成超億元融資、廣汽資本領投藍點觸控數億元 D 輪一汽把 L4 與具身智能列入十大重點技術任務。值得關注車企入場改變了具身智能的競爭要素——供應鏈復用小鵬 85% 供應鏈與汽車重合、規?;圃?、資金體量都是創業公司短板。造車廠做機器人將在 2027 年交付季與創業系正面碰撞。15. 優理奇獲柯力傳感戰投8.8 萬元機型單月交付超百臺上海優理奇機器人完成柯力傳感數千萬元戰略融資8/27。其 Wanda 2.0 輪式雙臂基礎版售價8.8 萬元已進入批量交付階段單月穩定交付超 100 臺、具備年產千臺產能在第二屆人形機器人運動會獲 1 金 1 銀 1 銅酒店場景賽連續兩年奪金。行業資本化同步提速銀河通用 25 億、跨維智能 10 億、智平方近 50 億融資宇樹 8 月科創板上市智元累計下線 15000 臺、已啟動赴港上市優必選 2025 年成為全球首個千臺級工業人形交付企業1079 臺。值得關注8.8 萬元 單月百臺 真實營收比估值故事更能說明商業化進度——具身智能投資邏輯正從技術敘事切換到交付敘事傳感器廠商柯力戰略入股也顯示產業鏈協同在加深。16. WRC 產業化縱深傅利葉13X生態與潤科具能具身智能 2.02026 世界機器人大會8/19-23的后續復盤顯示具身智能正從單點技術突破走向系統能力發展傅利葉以自研語義地圖讓多臺 GR-3 在模擬居家場景當智能管家自然語言完成安防、取物、陪伴、接待并提出13X生態戰略康養陪伴/商業服務/工業協作/科研教育四大場景攜一行凌光數據采集頭環、奇點智控光學六維力傳感器、伊塔動力關節模組、潤科具能集體亮相。潤科具能則系統闡釋具身智能 2.0不再復刻人體外形而是面向真實作業場景打造超人類性能特種機器人——半人馬機器人可攀爬 60cm 障礙、整機負重 150kg與火星車底盤組成協同編隊面向礦山巡檢、災害搜救、消防應急同步發布力量型雙臂機器人與自研電子皮膚觸覺手套。值得關注兩條路線并行清晰化傅利葉押平臺 生態做產業鏈連接器潤科押特種形態 超人類性能不做人形執念。對選型方前者適合服務業漸進落地后者在工業高危場景的 ROI 更直接。17. 大曉機器人三大行業方案從閃購倉到酒店洗衣的能交付清單大曉機器人在 WRC 現場展示三大解決方案曉滿即時零售一體化履約——履約機器人 W1 在高密窄倉作業、力控精度不超過 1 牛穩定處理柔性包裝與剛性商品覆蓋閃購倉/前置倉/倉店一體/無人便利店已與燒賣購、快客達、中石油便利店達成合作曉新打通酒店洗衣的收取、投放、清洗、折疊、熨燙連續作業曉途面向戶外開放環境的多形態適配、自主導航與集群調度已在城市治理與文旅場景落地。值得關注本屆大會的明顯轉向——展商從演示能力轉向帶客戶名單和交付清單。即時零售履約這個細分場景值得重點關注SKU 密度高、空間窄、24 小時波峰是機器人替代人力經濟性最容易算賬的場景之一。今日總評方向核心事件一句話判斷AI CodingCodex 持久模式曝光從被動應答到全天候自主的關鍵一步持久性同時放大能力與風險AI CodingGLM-5.3 權重如約開源純后訓練拿開源 SOTA能力競賽轉向練 Agent而非堆參數AI CodingClaude Code --restricted / Copilot 模型策略Agent 工具鏈進入企業治理時代沙箱、權限、審計成標配AI Coding云知聲中報 Work Agent 研報Agent 變現路徑被財報與研報雙向驗證下一站是辦公具身智能Coding Agent 零樣本操控機器人通用推理模型 最小接口開始挑戰專用策略訓練與 MHS 印證同一趨勢具身智能新勢力四家齊聚 優理奇單月百臺2027 年交付季前夜車企系、創業系在量產與成本上賽跑一句話總結本周 AI Coding 的主線是Agent 更自主也更需要治理持久模式、受限模式、模型策略同周落地具身智能的主線是從演示走向交付coding agent 直連機器人 車企量產時間表 8.8 萬元機型月交付百臺——數字世界與物理世界正在用同一套 Agent 范式收斂。