AIRelay
第 91 期 · 2026-08-02
DAILY AI INTEL

AIRelay 每日 AI 情报

2026-08-02 周日公开机会 + 基础设施交易

今天的机会不在再造一份抽象“AI 工作流”,而在五个已经出现明确成本或交付缺口的主体:Cursor 撤下自助计划的逐请求费用列,Tokimeter 同日用本地记录补位;OpenWork 把同一套技能与连接器带到多种智能体;Kedge 让轻量代理环境按实际资源计量;KAT-Coder-V2.5-Dev 以 35B 总参数、3B 激活参数开放权重;Slopsquatting 则把模型幻觉包名变成可重复的供应链攻击面。基础设施侧连续第五个目标日没有新增可验证样本,价格、库存、容量与供需方向继续保持未知。

Cursor + TokimeterOpenWorkKedgeKAT-Coder交易证据空窗 5 日

公开 AI 机会情报

5 个主体均未在近 5 期作为公开主体出现;成本可见性项以目标日的新变化开头。

01

新进展:Cursor 费用列移除 + Tokimeter|8 月 2 日把“账单前看不见逐请求成本”变成一项本地工具需求

Cursor 官方人员确认,7 月 31 日上线的改动让个人与自助 Teams 计划的 Usage 页面只显示 token,并从 CSV 移除美元成本;截至 8 月 2 日,目标讨论达到 138 条。Tokimeter 同日在目标日发布,可从 Claude、Codex、Cursor、Grok、opencode 等本地记录汇总到项目、会话、工具、模型、5 小时/周窗口与预算提醒。

为什么现在:近几期已出现会话 trace 与席位审计,本期的新变化是厂商主动移除逐请求费用字段,同时出现一个不上传遥测的开源补位工具;成本核对从“可选报表”变成续费和客户分摊前的证据缺口。

今天能做什么:用 2 小时让 Claude、Codex 与 Cursor 在同一测试仓库各完成一个固定只读任务,跑 Tokimeter 报告并与各自原生 usage、计划包含量和实际账单字段逐项对照;产出项目/会话/模型/token/窗口/可核费用/未知项矩阵。成功信号是 3 条会话均能归属到正确项目与模型,计划内与按量费用不混写,无法核对的成本明确标为未知。

怎么变现:向多工具团队卖“编码智能体成本分摊 + 月度账单复核”,钱点在找出高消耗会话、避免误分摊,并把缺失的厂商费用字段变成持续对账服务。相关链接:Cursor 费用字段讨论 ↗Tokimeter 发布页 ↗

02

OpenWork|8 月 2 日以周增约 2.7k stars 把技能、MCP 与团队权限放进同一跨智能体入口

OpenWork 是面向 macOS、Windows 与 Linux 的开源桌面应用;同一个 OpenWork MCP 可把分配给用户的 skills、plugins、MCP 连接与托管服务带进 Codex、Claude Code、Cursor 等客户端,团队控制面可按组织、团队或个人分配能力并限制模型与版本。8 月 2 日的 GitHub 周榜快照记录其新增约 2,720 stars,成为明确催化。

为什么现在:跨境团队同时购买多个智能体后,真正贵的是同一套入口验收、连接器授权和交付 SOP 被重复配置;本周增量说明“写一次、跨工具复用”已经从概念进入可下载、可审计的具体实现。

今天能做什么:用 2 小时在测试组织发布一份“API 入口验收”技能,分别从 Codex 与 Claude Code 调用同一能力,并测试团队分配、单人撤销和连接器最小权限;产出 skill 版本/hash、两端加载证据、OAuth 范围与撤销时间线。成功信号是两端加载同一版本,未分配用户不可调用,撤销后旧会话不能继续执行。

怎么变现:可卖跨智能体工作流迁移、团队权限初始化与月度版本审计,钱点在减少重复配置和版本漂移,并把一次安装变成持续治理收入。相关链接:OpenWork 开源仓库 ↗OpenWork 团队与连接文档 ↗

03

Kedge|8 月 2 日把可 fork 预览、全局 SQLite 与按实际资源逐秒计量推到开发者热议区

Kedge 的公开页把硬件隔离 Linux VM、瞬时 sandbox、跨实例复制的 /shared.db 与共享文件系统、按 PR 独立预览、自动扩缩和 scale-to-zero 放在同一平台;计费按实际 CPU 调度、活跃内存页与存储字节计算,而不是预留容量。8 月 2 日目标讨论达到 25 条,焦点已经落到 fork 边界、SQLite 写入者和快照熵重播种。

为什么现在:AIRelay 读者交付模型评测、临时代理和客户 demo 时,最容易浪费的是闲置 dev box 与每个分支手工搭环境;目标日讨论把“便宜部署”推进到状态复制、隔离和账单可解释三项可验收问题。

今天能做什么:用 2 小时从 SSH 发布一个只写测试数据的轻量函数,分别在主分支与预览分支写入 /shared.db,触发一次 scale-to-zero 后再访问;产出冷/热启动、分支隔离、跨实例数据、公开端点、资源用量与清理记录。成功信号是主分支未被预览改动污染、休眠后数据仍在、每次资源消耗可回查且测试环境可完整删除。

怎么变现:可卖“按任务启动的评测环境 + 每 PR 客户预览”,钱点在把闲置机器成本转成按使用付费,并缩短多客户 demo 的环境搭建时间。相关链接:Kedge 产品页 ↗Kedge 快速上手 ↗

04

KAT-Coder-V2.5-Dev|8 月 2 日以 35B 总参数、3B 激活参数的开放权重进入 Hugging Face 热门新面孔

模型卡显示它是 Apache-2.0 的文本模型,兼容 Transformers、vLLM、SGLang 与 KTransformers,官方评测表给出 SWE-bench Verified 69.40、Terminal-Bench 2.1 平均 41.02,并明确所有结果由项目方统一复跑、每个测试集只跑一次;模型不包含视觉组件。8 月 2 日它进入当日模型热榜,成为具体催化。

为什么现在:昨天的 DeepSeek 更新是付费 API 与 Codex 兼容,本期的新主体把更小的 3B 激活 MoE 开放到自托管路由;买方可以把“榜单分数”改成自己的完成任务成本、工具兼容和异常调用率。

今天能做什么:用 2 小时在已授权的权重端点或隔离推理节点跑 12 个固定 coding-agent 任务,与现用模型使用同一 harness、温度、工具表和上下文上限;产出 model ID、harness 版本、通过率、重试、工具幻觉、首字延迟、总 token 与 GPU 时间表。成功信号是至少 10 个任务可复现,未调用不存在的工具,且每个通过任务能回勾总资源消耗。

怎么变现:可卖开放权重接入、模型路由基准和私有部署验收,钱点在用 3B 激活结构探索更低的单位任务成本,同时用自有基准挡掉只看公开分数的错误采购。相关链接:KAT-Coder-V2.5-Dev 模型卡 ↗

05

Slopsquatting|8 月 2 日的 89 条讨论把 AI 幻觉包名从“模型出错”推成可重复的供应链攻击

目标日热议文章把攻击链拆成“模型发明不存在的包名—攻击者注册—开发者照抄安装”;其引用的 USENIX Security 研究覆盖 16 个模型、576,000 个 Python/JavaScript 代码样本,报告商业模型推荐包名至少 5.2% 不存在、开源模型至少 21.7%,并发现 43% 的已幻觉包名在同一提示重复 10 次时每次都会再次出现。

为什么现在:跨境交付正把 coding agent 接到可安装依赖的真实仓库,稳定复现的幻觉会给攻击者一份“该注册哪些名字”的候选清单;传统 lockfile、已知漏洞扫描和拼写相似度都挡不住第一次安装的新名字。

今天能做什么:用 90 分钟从一个隔离仓库收集最近 20 个由智能体新增的 npm/pip/Composer 依赖,逐项检查注册时间、维护者历史、官方仓库、下载趋势、签名/哈希和替代包,并给“首次出现 + 无可追溯来源”加阻断规则;产出依赖来源与放行表。成功信号是 20 个名字都有明确出处,任何新鲜、无维护历史或只有模型建议的包被隔离而未执行安装脚本。

怎么变现:可卖 AI 生成代码的依赖准入、首装隔离和供应链审计,钱点在上线前挡住一次恶意包、密钥外泄或重装返工。相关链接:Slopsquatting 分析 ↗包幻觉研究 ↗

AI 基础设施交易情报

连续第五个目标日没有新增供需证据;只发布停更边界、下一份证据要求与减损动作。

01

Claude Code / Pro / Max 号池|7 月 29 日至 8 月 2 日连续五日无新证据

供需情况分析
8 月 2 日没有新增套餐、模型标识、限制、并发、替换、到期或退款样本,需求升降、供给补货与稀缺方向均未知。
产品 / 容量线索
没有新的库存单位、价格锚点、5 小时/周容量或生命周期样本,7 月 28 日以前的标签只保留为历史。
热点议题
空窗达到 120 小时后,套餐归属、账户所有权、模型目录与 24 小时/7 日复测必须成为下一份样本的最低门槛。

为什么现在:证据间隔从 96 小时延长到 120 小时,继续沿用旧值会把采购误判直接带入新订单。

今天能做什么:维持“最后验证 7 月 28 日”标签,不新增采购或对外更新;只对已授权存量样本补齐套餐、所有权、model ID、限制、到期与复测时间戳。成功信号是每个在用样本都有责任人和最近核验日,历史值不再被当作当前值。

怎么省钱:避免把陈旧库存和容量承诺带进订单,减少替换、退款和集中售后。相关链接:Claude 方案说明 ↗Claude Code 速率限制说明 ↗

02

OpenAI / Claude Key + Azure|8 月 2 日连续第五日没有可交叉验证的能力样本

供需情况分析
当天没有新的组织/项目归属、区域、模型、采购 RFI 或可追责供方,供需方向保持未知。
产品 / 容量线索
没有新的 RPM/TPM、用量、余额、账单、折扣或结算锚点,不能形成价格、容量与库存结论。
热点议题
“官方”标签必须拆成组织所有权、区域可用性、模型访问、限额与账单责任五组证据。

为什么现在:连续五日无样本后,只靠标签采购会进一步放大区域错配、额度失效与账单归属风险。

今天能做什么:维持采购观察池;若收到已授权新样本,只采集同一时间戳下的组织/项目、区域、模型列表、限额、usage、余额、账单责任与撤销流程。成功信号是身份、能力、费用和责任四组字段能相互回勾。

怎么省钱:在预付前拦下不可验证资源,减少限额不足、区域不可用与结算争议造成的沉没成本。相关链接:OpenAI 项目管理说明 ↗Azure OpenAI 配额说明 ↗

03

高并发中转与路由|8 月 2 日连续第五日没有新的吞吐、计费或切换样本

供需情况分析
没有端点新增、停供或并发需求变化证据,买卖与稀缺方向均未知。
产品 / 容量线索
没有新的 1/5/20 并发完成率、P50/P95、429/5xx、重试、流式中断、request id、model ID、计费差或备用路由记录。
热点议题
下一次恢复更新必须绑定固定模型、固定输入、固定并发阶梯和同一账单窗口,不能用单张截图代替原始结果。

为什么现在:120 小时证据空窗让“高并发”“稳定”“自动切换”全部退化成无法验收的标签。

今天能做什么:冻结新路由结论,只保留存量线路告警;新样本到达后再按固定阶梯复测成功率、延迟、错误、重试、切换和计费。成功信号是一份能被第二次复跑复现的原始结果表。

怎么省钱:减少无效重试、路由抖动和无法归因的计费差。相关链接:OpenAI 速率限制指南 ↗Anthropic 速率限制文档 ↗

04

账号、支付与售后责任链|8 月 2 日连续第五日没有新的异常或责任边界样本

供需情况分析
没有新的合规账号供给、恢复请求、付款异常或售后责任变化证据。
产品 / 容量线索
没有认证、邮箱、号码、IP、付款主体、账单、恢复、替换或退款字段,无法估算当前生命周期成本。
热点议题
所有权、授权范围、支付责任、恢复路径与替换/退款窗口必须在任何扩批前闭环。

为什么现在:空窗达到五日后,“能登录/能付款”的历史结论更不能代表当前可用生命周期,批量放大会把恢复与退款成本集中到售后。

今天能做什么:不扩批,审计仍未关闭的存量订单,补齐所有权、授权、认证来源、支付责任、恢复路径、替换/退款窗口和售后负责人。成功信号是每笔存量订单都有完整责任链,缺项样本被隔离。

怎么省钱:把争议与恢复成本前置到采购验收,避免问题集中爆发后兜底。相关链接:OpenAI 账户安全指南 ↗Anthropic 账户支持说明 ↗

今日可执行项

今天可试

  • Tokimeter 对账≤2 小时;让 Claude、Codex 与 Cursor 在同一测试仓库完成固定任务;产出项目/会话/模型/token/窗口/可核费用/未知项矩阵;成功信号是三条会话归属正确、计划内与按量费用不混写。
  • OpenWork 验权≤2 小时;把同一份“API 入口验收”技能分配给 Codex 与 Claude Code,再撤销一个用户;产出版本/hash、加载证据、OAuth 范围与撤销时间线;成功信号是两端版本一致、未分配与已撤销用户不能调用。
  • Kedge 分支小样≤2 小时;发布一个只写测试数据的函数,分别在主/预览分支写入并触发 scale-to-zero;产出冷/热启动、分支隔离、数据持久化、资源用量与清理记录;成功信号是主分支未被污染、休眠后数据仍在且环境可完整删除。
  • KAT-Coder 12 任务基准≤2 小时;用固定 harness、温度、工具表和上下文跑 12 个 coding-agent 任务;产出通过率、重试、工具幻觉、时延、token 与 GPU 时间表;成功信号是至少 10 个任务可复现且没有调用不存在的工具。
  • 20 个 AI 依赖首装审计≤90 分钟;核注册时间、维护历史、官方仓库、下载趋势、签名/哈希与替代包;产出依赖来源与放行表;成功信号是无来源或新鲜包在执行安装脚本前被隔离。
  • 五日空窗止更复核≤30 分钟;确认号池、Key、路由与售后能力表仍标“最后验证 7 月 28 日”;产出待补证字段表;成功信号是旧数字不再进入当前价格、库存或容量口径。

暂缓观察

    风控 / 政策动态

    连续第五个目标日无新增基础设施证据

    零新增不能反推零需求、零风险、价格稳定或库存不变;7 月 28 日以前的值只保留为历史记录,本期不形成当前行情结论。

    Cursor / Tokimeter

    本地会话记录可能包含项目路径、命令、模型与用量;先确认采集范围、脱敏和删除。Tokimeter 的成本映射与 Cursor 已移除的逐请求美元字段都不能替代正式账单,计划包含量、按量费用与理论 API 成本必须分开。

    OpenWork

    同一远程 MCP 可把技能、插件和托管连接带到多个客户端,会扩大授权半径;真实接入前核组织隔离、OAuth scope、连接器主体、技能版本、日志、撤销和离职回收,不把生产密钥写进共享技能。

    Kedge

    SSH key 直接识别账户,公开 HTTPS、共享数据库与多区域复制会扩大数据面;测试只用非敏感数据,核 key 撤销、分支隔离、访问控制、区域、备份、删除和真实账单,不把 scale-to-zero 写成零成本承诺。

    KAT-Coder-V2.5-Dev

    模型卡基准由项目方统一环境单次复跑,且公开权重仅含文本模型;生产前单独核硬件、量化、上下文、工具协议、输出安全、许可证与地区可用性,不把公开分数外推成任务完成率或 SLA。

    Slopsquatting

    lockfile、已知漏洞扫描和拼写相似度不能覆盖首次安装的新名字;准入至少检查包年龄、维护者历史、官方仓库、签名/哈希、安装脚本和可替代依赖,AI 给出的包名只作为待核假设。

    账号与支付

    认证、号码、邮箱、IP、付款主体、区域可用性和售后责任须逐单核验;本报告记录市场与产品信号,不构成 AIRelay 报价、库存承诺、法律意见或可用性承诺。相关链接:OpenAI 使用条款 ↗Anthropic 使用条款 ↗

    一句话总结 / 今日提醒

    Cursor 费用列移除后应立刻用 Tokimeter 做三工具账单对照,OpenWork 与 Kedge 分别值得验证跨智能体权限和分支隔离;基础设施连续第五日没有新证据,旧价格、库存与容量继续停止外推。