# AI 世界日报｜2026-06-04

> 数据来源：AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准：实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。采集窗口：2026-06-02 20:00 UTC 至 2026-06-03 20:00 UTC。降级说明：BestBlogs 公共接口今日返回 `success=true` 但 `data=null`，本期“值得读 / 值得看”主要由 Follow Builders 与一手博客补位；GitHub、AI HOT、Follow Builders 采集正常。

## 一、今日主线判断

1. **Agent 工程化从“会写代码”转向“会组织工作”。** Claude Code 动态工作流、GitHub Copilot 桌面体验、Codex SDK/技能生态都在把子代理、技能、CLI、可视化反馈做成生产流程的一部分，OpenClaw 应优先补齐“任务编排 + 质量门 + 可回放”。
2. **企业 AI 的价值锚点继续向“受控落地”迁移。** Replit 接入 Microsoft Fabric、OpenAI Travelers 理赔助手、Anthropic Project Glasswing 都说明企业买单点不是模型炫技，而是治理、权限、审计、关键业务风险降低。
3. **近期 GitHub 爆发项目集中在 Skill、Office/HTML artifact、Agent memory、agent-ready 规范。** 这不是普通开源热榜，而是开发者正在把 AI Agent 的外围工具链商品化，对 ABU9 的售前方案、PPT、数据报表和交付审计有直接复用价值。
4. **模型侧竞争进入“成本可控的本地/开放推理”阶段。** Holo3.1、Step 3.7 Flash、开放模型使用量增长这些信号共同指向模型路由和成本观测的重要性，企业 AI 平台不能只绑定单一闭源模型。
5. **可信度分层比追热点更重要。** 今天的融资、IPO、benchmark、自称性能提升里混有媒体报道、官方宣传和 X 转述，日报已按一手发布 / 媒体报道 / X 传闻 / 待核实拆权重处理。

## 二、GitHub 近期爆发项目

### BigPizzaV3/CodexPlusPlus
- 是什么：CodexApp 增强工具，面向 Codex 使用体验和可用性扩展。
- 元数据：创建 2026-05-06；stars 12382；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_30d_500_ai_agent`，reason `new_30d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：Codex 外围工具开始形成“插件化生产力层”，OpenClaw 可借鉴其对 agent 使用体验、入口和状态反馈的封装方式。
- 链接：https://github.com/BigPizzaV3/CodexPlusPlus

### simonlin1212/a-stock-data
- 是什么：A 股全栈数据工具包，强调 7 层架构、27 端点、13 数据源、零第三方依赖，面向 AI coding assistants。
- 元数据：创建 2026-05-11；stars 3329；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_30d_500_ai_agent`，reason `new_30d|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：垂直数据 API + AI 编码助手是企业场景的高复用组合，ABU9 可按汽车售后、线索、DMS、车联网数据做类似“行业数据 skill 包”。
- 链接：https://github.com/simonlin1212/a-stock-data

### jdevalk/specification.website
- 是什么：面向 HTML、可访问性、安全、SEO、agent-readiness 的网站规范。
- 元数据：创建 2026-05-29；stars 479；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent`，reason `new_7d|recently_updated`。
- 判断标签：新变量
- 意味着什么：agent-ready specification 正在成为新交付物形态，适合沉淀 ABU9 的“汽车数字化项目验收规范”和 OpenClaw 生成站点质量门。
- 链接：https://github.com/jdevalk/specification.website

### yb2460/harness-anything
- 是什么：让 AI Agent 通过 COM 自动化控制 WPS Writer、Calc、Impress 的 CLI harness。
- 元数据：创建 2026-05-27；stars 361；最近更新 2026-05-31；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100`，reason `new_7d`。
- 判断标签：新变量
- 意味着什么：Office Agent 正从浏览器自动化走向本地办公软件控制，对 ABU9 的方案、标书、PPT、Excel 数据处理有直接落点。
- 链接：https://github.com/yb2460/harness-anything

### vercel-labs/zerolang
- 是什么：Vercel Labs 推出的“面向 agents 的编程语言”。
- 元数据：创建 2026-05-15；stars 4826；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_30d_500_ai_agent`，reason `new_30d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：Agent DSL/协议层会持续冒头，OpenClaw 不宜急着绑定某个 DSL，但应抽象任务、工具、文件、权限、质量门的中间表示。
- 链接：https://github.com/vercel-labs/zerolang

### butterbase-ai/butterbase
- 是什么：开源 backend-as-a-service，包含 Postgres、auth、storage、functions、AI gateway、MCP。
- 元数据：创建 2026-05-20；stars 1247；最近更新 2026-06-02；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_14d_200_ai_agent`，reason `new_14d|recently_updated`。
- 判断标签：新变量
- 意味着什么：MCP + AI gateway 正进入后端基础设施，企业 AI 项目需要从“接模型”升级到“接权限、数据、函数、审计”。
- 链接：https://github.com/butterbase-ai/butterbase

### MemPalace/mempalace
- 是什么：开源 AI memory system，主打 benchmark 和可免费使用。
- 元数据：创建 2026-04-05；stars 53366；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `fresh_90d_active_ai_agent`，reason `active_90d|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：记忆层已从“聊天历史”变成 Agent OS 的核心模块，OpenClaw 的 memory/wiki 应继续做结构化 claim、来源、复核条件，而不是只存流水。
- 链接：https://github.com/MemPalace/mempalace

### nexu-io/html-anything
- 是什么：Agentic HTML editor，提供 75 Skills、9 种输出表面、沙箱预览和一键发布。
- 元数据：创建 2026-05-11；stars 5967；最近更新 2026-06-02；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_30d_500_ai_agent`，reason `new_30d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：HTML artifact 正变成 Agent 的通用交付格式，ABU9 可以把日报、方案、驾驶舱、售前 PoC 统一到 HTML/PPT 双轨输出。
- 链接：https://github.com/nexu-io/html-anything

### OpenBMB/PilotDeck
- 是什么：任务导向 AI Agent productivity platform。
- 元数据：创建 2026-05-22；stars 2902；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_14d_200_ai_agent|new_30d_500_ai_agent`，reason `new_14d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：Agent 产品开始围绕“任务台”组织，而不是聊天框；OpenClaw 的长期界面也应突出任务、资产、质量门和回放。
- 链接：https://github.com/OpenBMB/PilotDeck

### pewdiepie-archdaemon/odysseus
- 是什么：Self-hosted AI workspace。
- 元数据：创建 2026-05-31；stars 42112；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent|new_30d_500_ai_agent|fresh_90d_active_ai_agent`，reason `new_7d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：待验证
- 意味着什么：3 天 4 万 star 的速度异常，需要打开代码与社区信号复核；如果为真，说明 self-hosted workspace 需求很强，如果为噪音则应避免被 star 诱导。
- 链接：https://github.com/pewdiepie-archdaemon/odysseus

### HKUDS/CLI-Anything
- 是什么：把各类软件变成 Agent-native CLI 的框架。
- 元数据：创建 2026-03-08；stars 41927；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `fresh_90d_active_ai_agent`，reason `active_90d|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：CLI 化是 Agent 接管既有软件的低成本路径，和 browser harness、Office harness 一起构成 OpenClaw 的工具接入主线。
- 链接：https://github.com/HKUDS/CLI-Anything

### heygen-com/hyperframes
- 是什么：Write HTML, render video，面向 agents 的 HTML 到视频渲染工具。
- 元数据：创建 2026-03-10；stars 23924；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `fresh_90d_active_ai_agent`，reason `active_90d|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：营销与培训内容会从 PPT/HTML 扩展到视频，ABU9 可关注“自动生成交付汇报视频、培训视频、门店介绍视频”的轻量链路。
- 链接：https://github.com/heygen-com/hyperframes

## 三、最近 7 天新项目：值得点开

### SenhorH/tab-labeler
- 是什么：本地重命名浏览器标签页，整理混乱会话。
- 元数据：创建 2026-06-02；stars 529；最近更新 2026-06-02；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100`，reason `new_7d|high_velocity|recently_updated`。
- 判断标签：新变量
- 意味着什么：小工具背后是浏览器工作台的状态管理需求；OpenClaw 浏览器 Agent 也需要标签、任务、证据链的可命名状态。
- 链接：https://github.com/SenhorH/tab-labeler

### cpaczek/skylight
- 是什么：用 RTL-SDR 将头顶飞机和天空图层实时投影到天花板。
- 元数据：创建 2026-06-02；stars 625；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100`，reason `new_7d|high_velocity|recently_updated`。
- 判断标签：噪音降权
- 意味着什么：项目增长快但与 AI/Agent 主线弱相关，仅作为“实时数据 + 可视化体验”旁支观察，不进入 ABU9 优先跟踪。
- 链接：https://github.com/cpaczek/skylight

### asz798838958/aBaiAutoplus
- 是什么：多平台 AI 账号自动注册与管理，并含协议化付款开通 ChatGPT Plus。
- 元数据：创建 2026-05-31；stars 1368；最近更新 2026-06-02；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent`，reason `new_7d|high_velocity|recently_updated`。
- 判断标签：噪音降权
- 意味着什么：增长快但合规风险高，不建议复用；只提示“账号自动化/灰产化”会成为企业 AI 安全与风控问题。
- 链接：https://github.com/asz798838958/aBaiAutoplus

### helloianneo/ian-xiaohei-illustrations
- 是什么：中文“小黑怪诞正文配图” Codex Skill。
- 元数据：创建 2026-05-27；stars 1904；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent|new_30d_500_ai_agent`，reason `new_7d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：视觉风格 skill 正成为内容生产的复用资产，ABU9 可沉淀“汽车行业咨询图、售后流程图、门店培训插图”风格包。
- 链接：https://github.com/helloianneo/ian-xiaohei-illustrations

### liyue-aigc/female-portrait-director
- 是什么：用于扩展 AI 女性肖像提示词的模块化 Codex Skill。
- 元数据：创建 2026-05-30；stars 503；最近更新 2026-06-01；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent`，reason `new_7d|high_velocity|recently_updated`。
- 判断标签：待验证
- 意味着什么：提示词导演类 skill 有传播性，但和企业 AI 相关度弱；仅保留其“模块化 prompt skill”形态，不跟内容方向。
- 链接：https://github.com/liyue-aigc/female-portrait-director

### GordenSun/GordenPPTSkill
- 是什么：中文 PPTX 模板 + 非破坏式文本编辑工具，面向 AI-friendly PPT 生成。
- 元数据：创建 2026-05-27；stars 1629；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent|new_30d_500_ai_agent`，reason `new_7d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：趋势增强
- 意味着什么：PPT skill 是 ABU9 立刻能用的方向，可用于售前方案、项目复盘、周报和客户高层汇报。
- 链接：https://github.com/GordenSun/GordenPPTSkill

### Sophomoresty/gemini-web2api
- 是什么：将 Gemini Web 转成 OpenAI-compatible API 的工具。
- 元数据：创建 2026-05-28；stars 1344；最近更新 2026-06-03；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100`，reason `new_7d|repeat_downgrade|high_velocity|recently_updated`。
- 判断标签：待验证
- 意味着什么：反映开发者对低成本模型入口的需求，但可能存在服务条款和稳定性问题，企业场景不能直接依赖。
- 链接：https://github.com/Sophomoresty/gemini-web2api

### op7418/guizang-social-card-skill
- 是什么：Claude Code / Codex skill，用单文件 HTML 生成小红书图文与公众号封面。
- 元数据：创建 2026-05-27；stars 2729；最近更新 2026-05-27；采集窗口/来源查询 `github.ranked_recent`，匹配 `new_7d_100|new_14d_200_ai_agent|new_30d_500_ai_agent`，reason `new_7d|repeat_downgrade|high_velocity`。
- 判断标签：趋势增强
- 意味着什么：社媒图文 skill 的工程形态可迁移到 ABU9 的客户案例卡片、产品能力卡片和销售朋友圈素材。
- 链接：https://github.com/op7418/guizang-social-card-skill

## 四、AI 热点新闻

### Claude Code 新增动态工作流功能
- 事件：Claude Code 支持运行时创建和协调多智能体工作流，用独立上下文窗口处理复杂任务。
- 可信度：一手发布
- 意味着什么：Anthropic 正把 agent orchestration 做成 Claude Code 的正式能力；OpenClaw 应把“子代理编排、任务隔离、token 成本、回放验证”列为核心基建。
- 链接：https://claude.com/blog/a-harness-for-every-task-dynamic-workflows-in-claude-code

### Claude Code 团队公开 AI-native engineering org 实践
- 事件：Claude Code 团队分享 JIT 规划、先问 Claude、代码审查分工等工程组织变化。
- 可信度：一手发布
- 意味着什么：AI 编程落地后的瓶颈从写代码转为验证、审查、安全和组织流程；ABU9 的 AI 转型也应先抓流程重构，而不是只买工具。
- 链接：https://claude.com/blog/running-an-ai-native-engineering-org

### Anthropic 扩展 Project Glasswing
- 事件：Anthropic 将关键基础设施安全计划扩展到约 150 个新组织，并用 Claude 系列协助漏洞扫描和修复。
- 可信度：一手发布
- 意味着什么：企业 AI 的可信落点之一是“高风险代码库安全”；汽车数字化项目里的 DMS、售后、车联网接口也需要类似 AI 安全扫描与补丁建议。
- 链接：https://www.anthropic.com/news/expanding-project-glasswing

### GitHub Copilot 应用强化 agent-native desktop experience
- 事件：GitHub 在 Build 2026 相关更新中将 Copilot App 定位为 agent-native 桌面体验。
- 可信度：一手发布
- 意味着什么：Agent 正从 IDE 插件走向桌面工作台，OpenClaw 的产品形态应更像“持续任务桌面”，而不是单次对话工具。
- 链接：https://github.blog/news-insights/product-news/github-copilot-app-the-agent-native-desktop-experience

### Holo3.1 发布本地计算机使用智能体
- 事件：H Company 在 Hugging Face 发布 Holo3.1，提供多尺寸模型与量化检查点，并宣称 AndroidWorld 分数和 token 吞吐提升。
- 可信度：一手发布
- 意味着什么：本地 computer-use agent 的性能/成本继续改善，但 benchmark 与吞吐提升属于官方自述，需等第三方复现。
- 链接：https://huggingface.co/blog/Hcompany/holo31

### 微软发布 MAI-Thinking-1
- 事件：微软发布首款高级推理模型 MAI-Thinking-1，并称软件工程 benchmark 接近领先模型。
- 可信度：媒体报道
- 意味着什么：微软在 OpenAI 之外加速自研模型，企业采购会看到更多“云厂商自有模型 + Copilot 工作台”的组合；性能声明需第三方验证。
- 链接：https://www.theverge.com/tech/941664/microsoft-ai-model-reasoning-mai-thinking-1-build-2026

### 微软开源 Adaptive Spec-driven Scoring
- 事件：微软发布可用文本描述创建 AI 行为测试和回归测试的框架。
- 可信度：媒体报道
- 意味着什么：AI 应用的交付门槛从“能跑”变成“可评估、可回归”；ABU9 AI 项目应把用户故事、风险点、验收测试转成 spec scoring。
- 链接：https://techcrunch.com/2026/06/02/new-microsoft-tool-lets-devs-spin-up-ai-behavior-tests-using-text-descriptions

### Replit 与微软合作发布 Fabric 集成
- 事件：Replit 宣布组织可在 Replit 构建内部工具、工作流或数据仪表板，并发布到 Microsoft Fabric。
- 可信度：X 传闻
- 意味着什么：内部工具生成正在进入企业数据治理平台，但当前来源为 X 官方账号短帖，落地细节需看正式文档。
- 链接：https://x.com/Replit/status/2061892255028486435

### Google DeepMind 开源 Science Skills
- 事件：Google AI Developers 称 DeepMind Science Skills 已在 GitHub 开源，用于科学智能体工作流。
- 可信度：X 传闻
- 意味着什么：垂直领域 skill 包会成为 agent 生态的基本资产；ABU9 可按汽车行业知识、流程、模板、数据接口做“Auto Digital Skills”。
- 链接：https://x.com/googleaidevs/status/2061924472245153863

### OpenAI 发布 Codex for Knowledge Work
- 事件：OpenAI 将 Codex 扩展到研究、数据分析、工作流自动化与内容创作等知识工作。
- 可信度：一手发布
- 意味着什么：Codex 不再只是编程工具，正在成为“知识工作 agent”；OpenClaw 的日报、Wiki、HTML 发布链路正好属于可产品化样板。
- 链接：https://openai.com/index/codex-for-knowledge-work

### Travelers 借助 OpenAI 部署理赔助手
- 事件：美国保险公司 Travelers 与 OpenAI 合作建设 AI Claim Assistant。
- 可信度：一手发布
- 意味着什么：理赔这种流程密集、规则密集、客户情绪高的场景与汽车售后/保修/事故维修相近，ABU9 可做汽车售后 AI 助手案例映射。
- 链接：https://openai.com/index/travelers

### Alphabet 融资与 Anthropic IPO 相关消息
- 事件：Bloomberg 节目提到 Alphabet 拟融资 800 亿美元、Anthropic 已秘密提交 IPO 申请等资本市场信号。
- 可信度：媒体报道
- 意味着什么：AI 基础设施资本开支继续抬高，但融资、IPO 属资本市场报道，不应和正式产品发布同权重。
- 链接：https://www.bloomberg.com/news/videos/2026-06-02/bloomberg-tech-6-2-2026-video

## 五、论文 / 研究 / 观点

### Anthropic Circuits 研究：区分因果效应相似的特征
- 观点：通过下游连接和 TWERA 权重来区分激活相似但实际因果效果不同的模型特征。
- 意味着什么：可解释性正在从“看激活”走向“判断输出影响路径”，对企业 AI 安全、审计、模型行为解释有长期价值。
- 链接：https://transformer-circuits.pub/2026/may-update/index.html

### OpenRouter 数据显示开放模型 token 使用增长
- 观点：Tomer Tunguz 基于 OpenRouter 数据称开放权重模型使用量显著增长，开放模型内部份额更替频繁。
- 意味着什么：模型路由会成为企业 AI 成本优化的常规能力；OpenClaw 应保留多模型路由、成本看板、任务级模型选择。
- 链接：https://www.tomtunguz.com/the-thriving-ecosystem-of-open-models

### Listen Labs：AI 语音访谈规模化客户研究
- 观点：Follow Builders 播客中 Listen Labs 强调用 AI 同时跑大量客户语音访谈，并沉淀受访者画像与未来回答预测。
- 意味着什么：ABU9 可用“AI 访谈 + 线索/售后客户画像”做经销商调研、客户满意度和门店运营洞察，但要防止模拟客户替代真实客户。
- 链接：https://www.youtube.com/watch?v=Rumft-rsEu4

### Claude Code workflow 观点：工作流是 skills/subagents 后的重要升级
- 观点：Thariq 在 X 上认为 workflows 是 Claude Code 继 skills 和 subagents 后的重要能力升级，尤其适合非技术任务。
- 意味着什么：非技术工作流是 OpenClaw 的机会区，日报、PPT、调研、客户方案都应逐步从“提示词”升级为可复用 workflow。
- 原帖链接：https://x.com/trq212/status/2061907538741006796

### Peter Yang：窄 SaaS 会被个人上下文 Agent 挤压
- 观点：简单窄 SaaS 与 $20/月订阅竞争困难，拥有个人上下文和记忆的 Codex/Claude Code 类 agent 更灵活。
- 意味着什么：ABU9 的产品化不能只做“窄工具”，要把行业数据、流程、服务和交付责任打包，形成 Agent + 服务的复合价值。
- 原帖链接：https://x.com/petergyang/status/2061846283263103274

## 六、今天值得读 / 值得看（BestBlogs / Follow Builders 精选）

- 标题/核心观点：Claude Code 动态工作流官方博客
- 为什么值得看：这是今天最重要的一手工程材料，讲清楚为什么复杂任务需要动态子代理和独立上下文。
- 链接：https://claude.com/blog/a-harness-for-every-task-dynamic-workflows-in-claude-code

- 标题/核心观点：Claude Code 团队如何运行 AI-native engineering org
- 为什么值得看：对企业 AI 落地最有价值的是流程和分工变化，不是单个工具技巧。
- 链接：https://claude.com/blog/running-an-ai-native-engineering-org

- 标题/核心观点：Anthropic Project Glasswing 扩展
- 为什么值得看：关键基础设施安全是企业 AI 的高可信落点，可映射到汽车行业代码安全、接口安全和供应商交付审计。
- 链接：https://www.anthropic.com/news/expanding-project-glasswing

- 标题/核心观点：Follow Builders 播客 Listen Labs 客户研究自动化
- 为什么值得看：AI 语音访谈把“用户研究”从少量访谈变成可规模化的运营系统，适合 ABU9 做经销商和车主洞察。
- 链接：https://www.youtube.com/watch?v=Rumft-rsEu4

- 标题/核心观点：AI skills 对窄 SaaS 的挤压
- 为什么值得看：Peter Yang 的判断直接关系到 OpenClaw 的商业定位：不要做孤立小工具，要做带记忆、上下文和交付责任的工作系统。
- 原帖链接：https://x.com/petergyang/status/2061846283263103274

- 标题/核心观点：Claude Code workflows 最适合非技术任务
- 为什么值得看：这条信号把 workflows 从“代码自动化”扩展到报告、研究、运营、审计等知识工作。
- 原帖链接：https://x.com/trq212/status/2061907538741006796

- 标题/核心观点：Codex / skills / plugins 进入日常工作流
- 为什么值得看：Thibault Sottiaux 提到 Codex business plan、网站托管分享、插件和 skills 改进，说明技能生态正在产品化。
- 原帖链接：https://x.com/thsottiaux/status/2061876999564791952

- 标题/核心观点：OpenAI Codex for Knowledge Work
- 为什么值得看：适合把“日报生成、Wiki 入库、HTML 发布、质量门”包装成 OpenClaw 可复用 demo。
- 链接：https://openai.com/index/codex-for-knowledge-work

## 七、对我们有用的行动建议

1. **给 OpenClaw 做 workflow 样板。** 把今天这条“采集数据 -> 生成日报 -> 质量门 -> HTML 发布 -> Wiki 入库”固化成可复用 workflow，并记录 token、耗时、失败点。
2. **做 ABU9 汽车行业 Skill 包第一版。** 先从售前方案、客户访谈、售后理赔/保修、门店培训 PPT、项目验收清单 5 个高频场景切入。
3. **补一套 Agent 质量门资产。** 参考 Adaptive Spec-driven Scoring 和 specification.website，沉淀“链接、可信度、元数据、ABU9 相关性、复核条件、HTML 发布”的验收规则。
4. **把 Office harness 纳入验证。** WPS/Office Agent 对国内企业更现实，优先试 `harness-anything` 是否能稳定控制 Writer/Calc/Impress，产出踩坑报告。
5. **建立模型路由与成本观察。** 关注 Holo3.1、Step 3.7 Flash、开放模型份额变化，但只在可复现 benchmark 和真实任务成本后进入生产建议。

## 八、今日结论

今天的核心不是某个模型更强，而是 Agent 正在形成“工作流、技能、记忆、质量门、企业治理”的生产体系；OpenClaw 和 ABU9 应抓这个体系化窗口，而不是追单点模型热度。
