# AI 世界日报｜2026-06-13

> 数据来源：AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准：实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。  
> 降级项：采集脚本中的 GitHub Search 匿名桶触发 403 rate limit，已用本机 `gh api` 认证请求按 `created/pushed/stars` 窗口补采；BestBlogs 今日接口返回 `success=true` 但 `data=null`，本栏以 Follow Builders、AI HOT 中的教程/官方博客/长观点替代；Telegram 正文长度如被截断，以 HTML 版为准；Wiki 已同步后运行质量门。

## 一、今日主线判断

1. **Agent 竞争从“模型更强”转到“运行时更完整”。** Codex 长运行云端环境、Cursor Auto-review、Replit Skills、Perplexity Computer 都在补权限、沙箱、工具、审查和持久会话。
2. **企业 AI 的落点正在从 Copilot 入口变成关键系统嵌入。** Anthropic-DXC、OpenAI-BBVA、腾讯混元 Infra、阿里 Meoo CLI 都说明：真正付费场景在部署、治理、流程改造和工程交付。
3. **Skill/Plugin 正在成为 AI 产品的新包装单位。** Grok 插件市场、Replit Skills、Claude/Codex 生态里的设计、PPT、审查、行业技能仓库，说明“可安装能力包”比单次 prompt 更可复用。
4. **GitHub 热度信号需要强降噪。** 近 90 天项目里出现极高 star 与描述异常项目，不能按总 star 直接排序；今天主榜只使用近期创建/更新、与 Agent/企业 AI/设计 artifact 强相关、且能解释业务价值的项目。
5. **对 ABU9/OpenClaw 的核心动作：做行业 Skill 包，而不是泛 Agent 展示。** 汽车销售助手、智能展厅、售前方案、交付审计、门店内容生成，应先沉淀成“可运行 Skill + 审查门 + HTML/PPT artifact”。

## 二、GitHub 近期爆发项目

### alibaba/open-code-review
- 是什么：阿里开源的混合架构代码审查工具，把确定性规则流水线与 LLM Agent 结合，支持行级评论、NPE/线程安全/XSS/SQL 注入等规则，兼容 OpenAI 与 Anthropic。
- 元数据：创建 2026-05-18；stars 6438；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：企业不会只买“会写代码”的 Agent，还会要求可审计、可解释、可插规则的质量门；OpenClaw 的开发/交付场景应把 review gate 产品化。
- 链接：https://github.com/alibaba/open-code-review

### vercel-labs/zerolang
- 是什么：Vercel Labs 推出的“面向 Agent 的编程语言”项目。
- 元数据：创建 2026-05-15；stars 5006；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：新变量
- 意味着什么：Agent 原生开发范式正在从“让模型读现有代码”走向“给 Agent 设计更适合执行的语言/中间层”；值得观察它是否能降低工具调用与状态管理复杂度。
- 链接：https://github.com/vercel-labs/zerolang

### KunAgent/Kun
- 是什么：嵌入应用内的 AI agent workspace，强调 Code 与 Write 两种模式。
- 元数据：创建 2026-05-21；stars 3853；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：Agent workspace 正在成为产品内能力，而不是独立 IDE；ABU9 的销售/售后/项目系统可以把“写方案、查知识、生成物料”嵌在业务页面里。
- 链接：https://github.com/KunAgent/Kun

### OpenBMB/PilotDeck
- 是什么：任务导向的 AI Agent productivity platform。
- 元数据：创建 2026-05-22；stars 3213；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：通用聊天入口正在让位于任务台/工作台；OpenClaw 若服务企业，应把任务、证据、工具调用、产物和复盘放在一个可追踪面板中。
- 链接：https://github.com/OpenBMB/PilotDeck

### nexu-io/html-video
- 是什么：面向 coding agents 的 HTML 转 MP4 工具，支持本地渲染、模板、配乐，定位为“programmatic video”。
- 元数据：创建 2026-05-27；stars 2930；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：AI artifact 从 HTML/PPT 扩展到视频；汽车门店短视频、车型卖点演示、培训片可以用“结构化数据 + HTML 模板 + 渲染”低成本生产。
- 链接：https://github.com/nexu-io/html-video

### diffusionstudio/lottie
- 是什么：用 Claude Code 或 Codex 生成生产可用 Lottie 动画的 TypeScript 项目。
- 元数据：创建 2026-06-04；stars 2389；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-30 stars:>200 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：AI coding 正在进入设计资产生产；OpenClaw 的设计/日报/方案系统可把动效、图表、页面组件作为可复用 artifact 输出。
- 链接：https://github.com/diffusionstudio/lottie

### shadcn/improve
- 是什么：用最强模型审计代码库并写计划，再交给便宜模型执行的工具。
- 元数据：创建 2026-06-10；stars 2349；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（`gh api` 认证补采）。
- 判断标签：新变量
- 意味着什么：模型路由开始按任务阶段拆分：强模型做架构/计划/审查，小模型做批量执行；这对 OpenClaw 的成本控制和多 agent 编排很直接。
- 链接：https://github.com/shadcn/improve

### MoonshotAI/kimi-code
- 是什么：Kimi Code CLI，定位为 next-gen agents 的起点。
- 元数据：创建 2026-05-22；stars 2282；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：国产 coding agent CLI 继续补位，企业客户会更关注国产模型、私有化、合规与成本；ABU9 项目可保留国产模型适配层。
- 链接：https://github.com/MoonshotAI/kimi-code

### butterbase-ai/butterbase
- 是什么：开源 backend-as-a-service，覆盖 Postgres、auth、storage、functions、AI gateway、MCP。
- 元数据：创建 2026-05-20；stars 1968；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：新变量
- 意味着什么：AI 应用后端开始把 MCP/AI gateway 作为基础能力；企业 Agent 平台不应只管模型调用，还要管身份、数据、函数和工具网关。
- 链接：https://github.com/butterbase-ai/butterbase

### GordenSun/GordenPPTSkill
- 是什么：AI 友好的 PPT 构建 Skill，提供中文 PPTX 模板和基于 `python-pptx` 的非破坏式文本编辑。
- 元数据：创建 2026-05-27；stars 1948；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：PPT/汇报材料是企业 AI 最容易变现的 artifact；ABU9 售前方案、客户周报、项目复盘应先沉淀模板和数据字段。
- 链接：https://github.com/GordenSun/GordenPPTSkill

## 三、最近 7 天新项目：值得点开

### XiaomiMiMo/MiMo-Code
- 是什么：小米 MiMo 相关代码仓库，当前描述缺失但短期 star 激增。
- 元数据：创建 2026-06-10；stars 6572；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（`gh api` 认证补采）。
- 判断标签：待验证
- 意味着什么：国产大厂 coding/model 项目传播很强，但描述缺失时不能按 star 直接入主跟踪；需复核 README、release、模型卡和 benchmark。
- 链接：https://github.com/XiaomiMiMo/MiMo-Code

### NoopApp/noop
- 是什么：离线 WHOOP companion，通过蓝牙配对设备，数据保留在本地，无云、无账号、无订阅。
- 元数据：创建 2026-06-07；stars 1528；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（`gh api` 认证补采）。
- 判断标签：新变量
- 意味着什么：虽然不是 AI 项目，但“本地优先 + 设备数据 + 隐私”是车端/店端 AI 的关键约束；ABU9 可参考其本地数据主权产品语言。
- 链接：https://github.com/NoopApp/noop

### nerding-io/n8n-nodes-mcp
- 是什么：n8n 的 MCP 节点扩展，让自动化工作流接入 MCP 工具生态。
- 元数据：创建 2026-06-06；stars 675；最近更新 2026-06-12；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（`gh api` 认证补采）。
- 判断标签：趋势增强
- 意味着什么：MCP 正在从开发者工具进入低代码自动化；企业流程集成时，n8n/MCP 组合可作为轻量 PoC 路径。
- 链接：https://github.com/nerding-io/n8n-nodes-mcp

### jwangkun/claude-for-financial-services-cn
- 是什么：面向 A 股金融场景本地化的 Claude Skills 集合，改编自 Anthropic 金融服务技能。
- 元数据：创建 2026-06-07；stars 约 355；最近更新 2026-06-11；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（采集脚本候选 + GitHub 补查）。
- 判断标签：趋势增强
- 意味着什么：行业 Skill 包是企业 AI 落地的轻量产品形态；ABU9 可照这个结构做汽车销售、售后、交付审计、经销商经营分析 Skill。
- 链接：https://github.com/jwangkun/claude-for-financial-services-cn

### Tencent-Hunyuan/UniRL
- 是什么：腾讯混元开源的统一多模态模型强化学习框架。
- 元数据：创建 2026-06-08；stars 约 518；最近更新 2026-06-11；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（采集脚本候选 + GitHub 补查）。
- 判断标签：新变量
- 意味着什么：多模态 RL 工程化会影响未来视频、图像、工具调用 Agent 的训练与评估；对 ABU9 暂时是技术观察，不是马上落地工具。
- 链接：https://github.com/Tencent-Hunyuan/UniRL

### JimLiu/baoyu-design
- 是什么：把 Claude Design 本地化为 Agent Skill，可生成 UI mockup、prototype、deck、wireframe，并支持设计系统导入。
- 元数据：创建 2026-06-07；stars 约 765；最近更新 2026-06-11；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（采集脚本候选 + GitHub 补查）。
- 判断标签：趋势增强
- 意味着什么：设计能力正在变成可安装 Skill；OpenClaw 当前技能体系应继续沉淀可复用设计系统和行业模板。
- 链接：https://github.com/JimLiu/baoyu-design

### amElnagdy/guard-skills
- 是什么：面向 coding agents 的质量门技能，用于捕捉 AI 生成代码、测试、文档中的常见失败模式。
- 元数据：创建 2026-06-06；stars 约 568；最近更新 2026-06-11；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（采集脚本候选 + GitHub 补查）。
- 判断标签：趋势增强
- 意味着什么：Agent 工程化的第二层护城河是 guardrail；OpenClaw 的日报、Wiki、开发任务都应该保留质量门，不靠人工记忆兜底。
- 链接：https://github.com/amElnagdy/guard-skills

### xiaohuailabs/xiaohu-video-translate
- 是什么：本地完成视频下载、转写、翻译、润色、字幕烧录的一条龙工具。
- 元数据：创建 2026-06-08；stars 约 463；最近更新 2026-06-10；采集窗口/来源查询 `created:>=2026-06-06 stars:>100`（采集脚本候选 + GitHub 补查）。
- 判断标签：新变量
- 意味着什么：本地内容流水线会降低培训、销售话术、售后教程多语言化成本；ABU9 可把门店培训视频处理成标准流程。
- 链接：https://github.com/xiaohuailabs/xiaohu-video-translate

## 四、AI 热点新闻

### Anthropic 与 DXC 达成全球联盟，将 Claude 引入关键行业系统
- 事件：DXC 将培训大量 Claude 认证前沿部署工程师，并把 Claude 引入银行、航空、保险、政府等关键系统；内部 OASIS 平台称 95% 代码由 Claude 编写，速度提升 10 倍。
- 可信度：一手发布；量化效果为官方案例口径，待第三方验证。
- 意味着什么：Anthropic 正在把 Claude 从工具卖法推进到 FDE/行业交付体系；ABU9 的 AI 转型也应配“行业部署工程师 + Skill 包 + 审查门”。
- 链接：https://www.anthropic.com/news/dxc-anthropic-alliance

### Anthropic 发布首次 Public Record 调查
- 事件：Anthropic 对约 5.2 万美国人做公众调查，显示公众既期待 AI 治愈疾病、辅助残障，也高度担忧失业、隐私、儿童安全与责任归属。
- 可信度：一手发布；样本和结论按官方方法解读。
- 意味着什么：企业 AI 方案不能只写效率提升，必须写治理、责任、员工再培训和安全边界。
- 链接：https://www.anthropic.com/news/anthropic-public-record

### Cursor 推出 Auto-review，用分类器智能体动态管控工具调用风险
- 事件：Cursor 在工具调用前加入分类器 Agent，根据上下文判断动作是否符合用户意图，高风险动作阻断并解释。
- 可信度：一手发布
- 意味着什么：Agent 权限治理会成为企业采购和落地的必答题；OpenClaw 应把敏感文件、外发消息、生产数据操作做成统一审查层。
- 链接：https://cursor.com/blog/auto-review

### OpenAI 计划收购 Ona，强化 Codex 长运行云端环境
- 事件：OpenAI 宣布计划收购 Ona，用于拓展 Codex，提供安全、持久的云端环境，支持企业工作流中的长时间运行 AI Agent。
- 可信度：一手发布
- 意味着什么：长任务、持久沙箱、企业权限是 coding agent 竞争核心；OpenClaw 若要做企业级，需要把会话、节点、文件、审计、回滚全部产品化。
- 链接：https://openai.com/index/openai-to-acquire-ona

### OpenAI 推出 Codex 浏览器开发者模式
- 事件：OpenAI Developers 称 Codex 可在 Chrome 和内置浏览器中使用 CDP 调试页面，分析控制台、网络、性能和页面状态。
- 可信度：一手发布
- 意味着什么：浏览器 Agent 不再只是点击网页，而是接入 DevTools 级诊断；OpenClaw 的 browser-harness 应重点沉淀 CDP、截图、日志、像素检查能力。
- 链接：https://x.com/OpenAIDevs/status/2065226355495895521

### OpenAI Codex 推出速率重置攒存功能
- 事件：OpenAI 称 Codex 用户可把一次 rate limit reset 保留到自己方便时使用，先面向 Go、Plus、Pro、Business 用户推出。
- 可信度：一手发布
- 意味着什么：AI coding 已经进入“额度运营”阶段；OpenClaw 长任务应记录预算、消耗、失败重试，避免夜间任务卡在额度上。
- 链接：https://x.com/OpenAI/status/2065225362544726371

### MiniMax 发布开源权重模型 M3
- 事件：MiniMax 宣布 M3 约 428B 总参数、23B 激活参数，强调 coding、agent、长上下文与多模态能力，权重与技术报告预计约 10 天后发布。
- 可信度：一手发布；benchmark 与能力描述待第三方验证。
- 意味着什么：国产开源权重模型继续补 coding/agent 能力；企业私有化方案可纳入候选，但要等权重、许可证、评测和部署成本清楚后再选型。
- 链接：https://x.com/MiniMax_AI/status/2065436935188058208

### Kimi 发布并开源 Kimi-K2.7-Code
- 事件：Kimi 宣布 K2.7-Code 发布并开源，称代码 benchmark、推理效率和长时编码任务成功率提升。
- 可信度：一手发布；官方 benchmark 待第三方验证。
- 意味着什么：coding model 的国产竞争加速，ABU9/OpenClaw 应保持模型适配层，不把工具链锁死在单一供应商。
- 链接：https://x.com/Kimi_Moonshot/status/2065377579130142937

### 字节豆包上线“任务模式”
- 事件：豆包大范围上线任务模式，支持定时执行、代码运行、文件生成、网页生成、PPT、数据可视化等 Agent 执行链路。
- 可信度：媒体报道
- 意味着什么：C 端入口也在教育用户“AI 可以替你跑任务”；企业端会更快接受定时任务、文件产出、数据分析型 Agent。
- 链接：https://www.ithome.com/0/963/725.htm

### Perplexity Computer 集成 Deep Research
- 事件：Perplexity 将 Deep Research 作为 Computer 原生技能，连接搜索、代码生成、长运行沙箱、连接器、工具和授权数据。
- 可信度：一手发布
- 意味着什么：搜索、研究、执行正在合并为 Computer Agent；企业知识工作流会从“搜资料”升级为“搜、算、连系统、产出”。
- 链接：https://x.com/perplexity_ai/status/2065124930463916317

### 腾讯混元 AI Infra 开源升级 HPC-Ops 推理算子库
- 事件：腾讯混元开源五类推理核心算子，覆盖 Attention、Router GEMM、FusedMoE、Fused AllReduce+Norm、Sampler，并给出多项加速数据。
- 可信度：媒体报道 / 官方公众号；性能数据待第三方验证。
- 意味着什么：国产推理优化继续向生产细节下沉；企业私有化部署的成本竞争会越来越依赖 infra 能力而非单纯模型选择。
- 链接：https://mp.weixin.qq.com/s/y0vd1cpvWXLSssL1kXxguw

### Prometheus 融资 120 亿美元、估值 410 亿美元的说法流传
- 事件：X 上流传 Bezos 相关 AI 公司 Prometheus 以高估值融资，定位“人工通用工程师”。
- 可信度：X 传闻
- 意味着什么：未有一手公告前不能按事实处理；但“AI + 工业数据 + 设计到制造闭环”的叙事值得 ABU9 观察，因为汽车数字化天然拥有流程数据入口。
- 链接：https://x.com/kimmonismus/status/2065097988859744503

## 五、论文 / 研究 / 观点

### olmo-eval：面向模型开发循环的评估工作台
- 观点：AllenAI 发布的 olmo-eval 强调开发阶段反复评测，支持 agentic 和多轮评测，并报告标准误差与最小可检测效应。
- 意味着什么：Agent 评估不能只看一次 demo 成功；OpenClaw 应把任务成功率、回归用例、工具调用错误、成本波动纳入持续评测。
- 链接：https://huggingface.co/blog/allenai/olmo-eval

### 全自主无人机首次击毙人类士兵的报道需要严肃跟踪
- 观点：如果 New Scientist 报道细节成立，自主武器已从伦理讨论进入实战风险。
- 意味着什么：企业 AI 虽不同于武器系统，但“自主决策边界、人类确认、责任链”会成为所有 Agent 系统的共同治理问题。
- 链接：https://www.newscientist.com/article/2529849-fully-autonomous-drones-have-killed-human-soldiers-for-the-first-time

### LLM 在核危机模拟中高频选择战术核武器的研究提醒
- 观点：相关模拟称 LLM 在 95% 的场景中选择使用战术核武器，具体模型和实验设置需复核。
- 意味着什么：高风险场景不能把模型输出直接当决策；ABU9/OpenClaw 的生产流程也要定义“只建议、不自动执行”的红线。
- 链接：https://www.kennethpayne.uk/p/shall-we-play-a-game

### Swyx 的 Loopcraft 观点：下一阶段是会堆循环的人胜出
- 观点：Swyx 认为未来竞争在于有效堆叠循环：出问题时能下钻提高可靠性，模型变强时能上升放大杠杆。
- 意味着什么：OpenClaw 不应只做单任务 Agent，而要沉淀“采集-判断-生成-质量门-Wiki-发布”的复利循环。
- 原帖链接：https://x.com/swyx/status/2065307558198567206

### OpenRouter 基准探索器强化“性能-价格-场景”的模型选择思路
- 观点：OpenRouter 推出多基准帕累托曲线，说明模型选择正在从单榜排名转向多维权衡。
- 意味着什么：OpenClaw 的模型路由不应只按“最强模型”，而要按任务风险、上下文、延迟、成本、工具调用成功率选型。
- 链接：https://x.com/OpenRouter/status/2065094780271329729

## 六、今天值得读 / 值得看（BestBlogs / Follow Builders 精选）

- 标题/核心观点：Swyx 说 AI coding 平台缺的是“一次性吞掉 webmaster infra”的闭环。  
  为什么值得看：这正是 OpenClaw 的机会：把监控、错误反馈、部署、分析、技能安装、告警合并为一套运行时，而不是让用户到处装工具。  
  原帖链接：https://x.com/swyx/status/2065264832056889711

- 标题/核心观点：Amjad Masad 认为 Fable 上 Replit 后，vibecoding 更需要便宜和快速，而不是继续堆 IQ。  
  为什么值得看：这支持“强模型规划 + 便宜模型执行 + 审查门”的路线；OpenClaw 的夜间任务尤其需要成本分层。  
  原帖链接：https://x.com/amasad/status/2065236013627351551

- 标题/核心观点：Replit 分享专家级提示词技巧。  
  为什么值得看：面向 Agent 的提示词正在变成可复制的产品方法，ABU9 内部可以把售前、交付、客户访谈提示词沉淀成标准 Skill。  
  链接：https://x.com/Replit/status/2065192392718733327

- 标题/核心观点：Spec 驱动开发三件套覆盖 Spec -> Implement -> Verify。  
  为什么值得看：这与企业交付天然一致：需求规格、技术规格、变更验证必须随 PR/交付物一同保存。  
  原帖链接：https://x.com/shao__meng/status/2065234132431675439

- 标题/核心观点：qiaomu-ai-prd 把一句话需求转成 AI 更容易执行的 PRD。  
  为什么值得看：Agent 开发不是“人喜欢的 PRD”，而是机器可执行规格；ABU9 项目可把客户需求转成结构化 PRD 再进入开发/交付。  
  原帖链接：https://x.com/vista8/status/2065264509170876417

- 标题/核心观点：小互开源公众号自动排版技能组合。  
  为什么值得看：内容发布链路正在 Skill 化；ABU9 的客户周报、案例文章、售后通知可用同类方式降低人工编辑成本。  
  链接：https://x.com/xiaohu/status/2065278092441268246

- 标题/核心观点：baoyu-design skill 支持导入 Figma 本地文件重建设计系统。  
  为什么值得看：设计系统成为 Agent 输入资产后，企业 UI/方案/原型可保持一致风格；OpenClaw 应强化“本地设计系统 + artifact 输出”。  
  链接：https://x.com/dotey/status/2064959133535658144

- 标题/核心观点：Anthropic Claude Corps 项目用 Claude 培训并支持非营利组织。  
  为什么值得看：这是“模型公司 + 人才训练 + 场景部署”的组织打法，和 DXC 联盟一起说明 FDE 化是 Anthropic 的主线。  
  链接：https://www.anthropic.com/news/claude-corps

## 七、对我们有用的行动建议

1. **OpenClaw 增加统一 Auto-review 层。** 把外发消息、生产数据、删除/配置变更、花钱 API、真实身份使用做成可配置风险分类器，输出“放行/阻断/请示”。
2. **ABU9 先做 4 个行业 Skill 包。** 销售顾问话术、智能展厅讲解、售前方案/PPT、交付审计/周报；每个 Skill 必须有输入字段、输出 artifact、质量门和复核条件。
3. **建立模型路由与成本观测表。** 对 coding、研究、PPT、HTML、长文、翻译、数据分析分别记录模型、成本、失败率和人工返工率，避免“强模型通吃”。
4. **把汽车业务知识库拆成可执行规格。** 不只存文档，要转成客户画像、车型卖点、流程节点、常见异议、系统字段、权限边界，方便 Agent 调用。
5. **用 Wiki 做趋势记忆，而不是日报归档。** 每天只沉淀 claim、项目、玩家、行动建议和复核条件；重复出现三次的趋势才升权进入 ABU9 路线图。

## 八、今日结论

AI 世界今天最明确的方向是：模型能力继续涨，但真正可落地的价值正在转向 Agent 运行时、行业 Skill 包、审查门、成本路由和可交付 artifact；ABU9/OpenClaw 应把这些做成体系，而不是追热点做演示。
