Daily Intelligence / 2026-09-25

AI 世界日报

AI 世界日报精华版

今日重点项目雷达

01

安全 / 治理

02

产品 / 成本

03

开源 / 安全工具

采集:Mac 已连 → collect_ai_world_daily.py(JSON ~1.1MB,errors=[])+ 官方页核对(Claude / GitHub Changelog / Anthropic Engineering 回源 / HF / 中文站)。相对 2026-09-24 筛过夜新变量;Medicare、Marketplace、Cursor Rollouts、ART 酶、Antigravity、Ember-1、Gemini TTS 昨已报,不再当主新闻。AI News 自有发布。厂商与研究者自报数字标待第三方验证。

一、今天一句话

昨夜重点不在「再出一个模型」,而在权限怎么写细:频道里能用个人连接器了(Claude Tag)、GitHub 企业高危动作要「人在场」再认证、网上开始成规模用 GEO 把假电话塞进 ChatGPT / Gemini 回答——店端知识页和机器人外发都碰得到。

二、本周动作(已定)

把权限表写实,补三块新例子。 频道里用个人连接器:谁的账号、回帖前谁看、无人值守仍走共享连接器(对照 Claude Tag)。高危动作要本人在场再认证,不能只靠长活会话(对照 GitHub proof of presence)。店端 / 知识页 / 销售助手:电话、邮箱、登录入口以官网为准,AI 搜到的联系方式先人核(对照 GEO 投毒)。昨天的研究 agent 撞墙停手、Medicare 通知时限、Muse / ZCode 行继续留在表里,不另开项目。

模型短名单继续只试用。 Sol / Luna、Opus 5.5 仍在候选。长会话先看缓存命中(Anthropic 称长 coding 会话成本差主要来自缓存读降价,厂商)。生产默认本周不切。挑 1–2 个真任务做 A/B。

Origin 一页纸日期改到至少 9/25。 昨天已写的 Rollouts(上线后盯回归)和 Security Reviewer 保留。补一句企业侧对标:高危合并 / 改安全设置前要「人在场」认证——先记口径,不本周强上。

三、今日卡片

安全 / 治理

#### Claude Tag:频道里可用「个人连接器」,发前可先给你看

  • 摘要:2026-09-24 Claude 官方。Slack 频道里的 Claude Tag(beta)以前只能用管理员挂到频道的共享连接器;现在你点名提问时,可以用你自己账户上的连接器(日历、网盘、CRM、预发环境等),别人用不了你的。回帖可先审再发,也可自动发(敏感内容仍拦);企业版管理员可强制全员先审。无人值守的定时任务仍只用频道共享连接器。Team 先开,Enterprise 随后。
  • 有什么用:OpenClaw / 内部机器人直接对标——共享工具 vs 个人登录、发前审 vs 自动发、定时任务不许挂私人凭证。权限表补三行就能用,别让员工在群里私接网盘。
  • 来源 · https://claude.com/blog/claude-tag-now-supports-personal-connectors-in-channels · 一手

#### GitHub:高危动作可要求「证明人在场」

  • 摘要:2026-09-24 GitHub Changelog。Enterprise Cloud(托管用户 + Entra ID SSO)可对高危动作开启 proof of presence:建 token、改 webhook、改组织安全设置、看恢复码等,先被送回身份提供商做再登录或 MFA,通过才放行。针对被偷的会话 cookie / 长活 token;通过后同浏览器约两小时内同类动作免再验。PR 合并前强制尚在路上。公开预览。
  • 有什么用:权限表与 Origin 流水线的企业对标——「有有效会话」不等于「此刻是本人」。友车若走 GitHub EMU + Entra,可评估;OpenClaw 外发 / 改权限类动作也应默认先人确认。
  • 来源 · https://github.blog/changelog/2026-09-24-require-proof-of-presence-for-high-impact-actions/ · 一手

#### GEO 投毒:AI 回答里出现假客服电话(374 家企业,研究者称)

  • 摘要:安全研究者 Ariel Simon 等发文(约近两日;AIHOT 9/25 收录)。称攻击者用生成式引擎优化(GEO)在论坛、PDF、UGC 站铺假联系方式,诱使 ChatGPT、Gemini、Google AI Overview 在用户查航司 / 银行 / 平台客服时给出诈骗电话或钓鱼页;点名 Delta、汉莎、BoA、Airbnb 等。自称侦测到约 374 家受害企业(研究者数字,待第三方复测)。称已向 Google / OpenAI 报漏洞赏金,多被判「不在范围 / 难复现」。
  • 有什么用:店端销售助手、知识页、报价口径——联系方式只认官网与主机厂通稿,禁止「让模型搜一个电话」。对外话术:AI 给的号码要二次核实。权限表加「外链 / 网页代读结果不当事实」。
  • 来源 · https://medium.com/@arielsimon/dark-sourcery-how-hackers-manipulate-ai-to-scam-you-88df434d2073 · 媒体/研究者(数字待核实)

产品 / 成本

#### Anthropic:Opus 5.5 为「更长、更重上下文」的 coding 会话算账

  • 摘要:2026-09-24 Claude 官方工程向博文。复述 Opus 5.5 相对 Opus 5 典型负载约低 40% 成本(厂商);强调近半年 Claude Code 单次请求上下文约增 2.6×、缓存读占比升高,所以缓存读降价 60%对长会话更敏感。建议:开场定模型别中途乱切、离开前先 compact、API/云侧可开一小时缓存。开篇数字与 9/22–23 发布口径一致,本条当「怎么用」补丁,不当新模型发布。
  • 有什么用:短名单试用时盯 /usage 缓存命中;OpenClaw 长任务别中途换模型打断缓存。仍不切生产默认。
  • 来源 · https://claude.com/blog/claude-opus-5-5-built-for-coding-sessions-that-use-more-context · 一手(成本数字待第三方验证)

开源 / 安全工具

#### GitHub Security Lab:LLM 驱动的 C/C++ 自主 Fuzz 流水线

#### Liquid AI:视觉模型投机解码草稿 LFM2.5-VL-DSpark

  • 摘要:2026-09-24 HF 博文。为 LFM2.5-VL-3B 释出约 2.8 亿参数草稿模型,厂商称端侧解码最高约 3.13×、H100 约 2.66×(待复测);日一支持 llama.cpp / MLX-VLM / SGLang。投机只加速解码,不加速视觉编码与 prefill。
  • 有什么用:店端 / 本机多模态小样的速度旁路;先看许可证与实测,不进本周动作。
  • 来源 · https://huggingface.co/blog/LiquidAI/lfm2-5-vl-dspark · 一手(速度数字待第三方验证)

四、GitHub 值得关注

Mac collect github.ranked_recent(74)按友车 / OpenClaw / ABU9 用途筛过;排除刷星空壳、水印灰产、APK 逆向、钱包贴图壳等。另手头补入本轮官方 Fuzzing Taskflow 两仓。星数为采集时点;Security Lab 两仓星数暂缺(API 限流),以仓链为准。共 60 个。

五、WATCH

  • OpenAI DevDay 下周二:Codex 负责人 Tibo 原帖称「会改你工作方式」;等官方日程与产品页再升主栏。 · https://x.com/thsottiaux/status/2102996313780736363
  • GPT Voice 大升级(可调邮件/日历等):昨已旁观;仍等正式产品页。 · https://x.com/gdb/status/2102821706041819401
  • Claude Code Cloud sessions 抵用金口径:团队称按订阅跑,推广为 Pro $100 / Max $250 一次性抵用(社媒/二手,待官方账单页)。
  • Arena / AA 上 Opus 5.5 编程榜:第三方分数波动期,作短名单旁注,不单独驱动切换。
  • OpenAI×苹果 ChatGPT 合作低于预期(法庭文件):行业旁观,不进本周动作。
  • OpenAI Daybreak 向乌克兰民防开放:地缘/安全旁观。 · https://openai.com/index/openai-extends-cyber-access-to-ukraine-for-civilian-defense
  • Medicare / Transluce 续报:昨已写进权限表;更多日志披露不新开项目,只加固「撞墙停手 + 通知 SLA」。

六、Grok Bot / Cursor 用法增量(相对昨)

  • 无新的 Grok Bot 公开用法帖需进主栏(相对 9/24)。
  • 对标增量(非 Grok):Claude Tag 的「个人连接器 + 发前审」可借鉴到内部机器人频道治理;GitHub proof of presence 对应「高危动作不能只靠长会话」。
  • Cursor Rollouts / Security Reviewer 昨已报,不重复。

七、全文垫后(采集备注)

  • Mac collect errors=[];ranked_recent 74 条;列入栏的 GitHub 仓 60。
  • Anthropic Engineering 旧文(含 5 月 containment、4 月 postmortem)出现在 Follow Builders 博客信号里,已回源确认日期,不写入今日主栏。
  • 软失败:z.ai/blog 404;机器之心首页壳薄;GitHub API 星数限流(Security Lab 两仓星标为 —)。
  • Sepia 人话终检:拆「个人连接器 / 人在场认证 / GEO 假电话」三块;禁工单英文;厂商与研究者数字旁注条件。
  • 本版发布 flyingnick HTML;未碰 Telegram;花费未超 ¥100。