更新时间:18:30|覆盖窗口:2026-08-19 ~ 08-20(承接上一期 2026-08-19)
数据来源:GitHub Trending / Product Hunt / Hacker News / RSS(OpenAI / Anthropic / Google AI / Meta AI / DeepMind / HuggingFace / Mistral / NVIDIA / The Decoder / Juya / AI Hot 等)/ 金十电报
数据覆盖与缺口(抓取失败 / enrichment 缺失在"状态"列标注,不展开成段落):
| 源 | 入库数 | 状态 |
|---|---|---|
| Product Hunt | 22 | ✓ |
| Hacker News | 26 | ✓ |
| GitHub Trending | 14 | ✓ |
| RSS | 65 | 15 个 feed 当日 0 条(Stratechery / Juya RSS / HuggingFace / NVIDIA / 微软 AI / Ben's Bites / TLDR AI / Import AI / Latent Space / Interconnects / One Useful Thing / Miessler / YouTube×4),属 feed_empty 正常空返回,非抓取失败;Juya 已源站直抓补齐 |
| 金十电报 | 400 | ✓(AI 相关占比低,已过滤) |
这份日报是一张二维坐标系:纵轴看模型与产品的能力 / 技术往哪走(实验→收敛中→事实标准,判档看证据强度,同一矢量当天 ≥2 个独立证据才算收敛),横轴看 AI 产品被多少人、多少场景真用上(萌芽→早期采用→主流化,判档看真实使用信号,不看 star / votes)。
一句话结论
地图今天没跨档,是证据积累日——但增量最厚的是纵轴 v-skills:一批 agent 框架 / 沙箱项目(obra superpowers、火山 OpenViking、OneCLI、CHAP、smolvm)同一天涌进 GitHub Trending,加上 Claude Code 工具链更新,能力侧"工具标准化与运行时"这条线从"实验室在试"往"有人真在做"又垫厚一截;v-security 同步吃下 OpenAI 把零数据保留 + 暂停前沿训练两周一起推的重磅,攻防三面(数据保留 / 训练暂停 / 沙箱隔离)同日闭合。今天没有 S-confirmed,候选仍是上期的两个——DeepSeek V4 Pro 0813 + Harness、GLM-5.3——都卡官方验证节点(8/24、8/28),预算 2/2 占满。接下来两天最该盯:8/21 Anthropic Model 2 官方是否确认(T-135)、8/24 DeepSeek V4 Pro 权重是否如期放出(候选①)。
重点候选 · 待验证
两个 S-candidate 均从上期沿用,深挖预算 2/2 占满,无新对象触发候选(今日 Stripe-OpenRouter 是并购、OpenAI ZDR 是安全特性,均不命中"旗舰新基础模型 / 新产品线 / 重大开放权重重构"候选触发条件)。
① DeepSeek V4 Pro 0813 + Harness —— 重点候选,尚缺可下载权重与官方 model card
- 为什么重要:命中候选触发条件①(重点厂商旗舰级新一代基础模型 + 重大开放权重重构);若权重如期放出并过独立复核,可能把
v-openflagship从"收敛中"再向前推一格。 - 确认阻断项:V4 Pro 0813 可下载权重原定 8/24 未到、缺官方 model card;能力仍部分绑定脚手架(Harness)。
- 下一步验证:8/24 看官方权重页与 HF 页是否落地、Simon Willison / Artificial Analysis 是否独立复核(→T-116 母题)。
- 已有证据:[AI Hot 转述]|[发布动态]|查看原文;[AI Hot 转述]|[Harness 测试]|查看原文
② GLM-5.3(智谱)—— 重点候选,尚缺官方 model card / 可下载权重页
- 为什么重要:命中候选触发条件①;已登顶开源 AI Index 60,把
v-openflagship添了中国开放模型顶流,是v-openflagship本轮最实的增量之一。 - 确认阻断项:缺智谱官方 model card / 可下载权重页、独立 benchmark 复核待补、OpenRouter 具体模型页未解析。
- 下一步验证:8/28 看权重能否如期放开、智谱官方页是否放出(→T-136 子项);唐杰"后训练对照实验"表述需官方页佐证。
- 已有证据:[AI Hot 转述]|[登顶开源]|查看原文;[Juya AI Daily 第三方转述]|[后训练洞察]|查看原文
纵轴 · 能力与技术演进
v-openflagship(开放权重 / 开源旗舰)—— 档位:收敛中
- 实验室侧(中国开放模型继续增殖):蚂蚁百灵开源 Ling-3.0-tiny / flash 共 6 个 Base Model 检查点(覆盖预训练、中期训练、WSM 合并三阶段);Ornith 开源 Ornith-1.5 系列(397B / 35B MoE + 9B dense,MIT,扩展 self-scaffolding 自我改进循环);字节 Seed 基础模型新设四个一级部门(向吴永辉汇报,背景为训练超 5 万亿参数模型、走向全模态);智谱唐杰称 GLM-5.3 与 5.2 同基座同参数量、仅一月后训练扩展即显著提升(后训练对照实验)。
- 证据:[Juya AI Daily]|[22 条早报]|查看原文
- 开源侧(小模型量化继续拉低部署门槛):Liquid AI 发布 LFM2.5 四款 QAD Q4_0 GGUF 检查点(恢复约 97% 量化损失的 BF16 平均精度);Unsloth 发布 Qwen3.8-27B Dynamic v3.0 量化(同等体积 top-1% 准确率领先超 10%,1-bit 量化可在 8GB 内存运行、保留约 77% BF16 准确率)。
- 证据:[Juya AI Daily]|[量化发布]|查看原文
- 还卡在哪:跨厂完整可比评测仍缺;V4 Pro 0813 权重 8/24 未到、GLM-5.3 官方页与权重 8/28 待核——都是"开放度增殖"而非"真旗舰可下载",所以今天不进档。
- 别高兴太早:这批都是可用 / 开放度层面的增殖,真旗舰可下载(DeepSeek V4 Pro、GLM-5.3 权重)还没落,离"事实标准"还差独立复现与生产采用。
v-longtask(长任务可靠性)—— 档位:收敛中
- 实验室侧:Claude 自主完成计算蛋白质设计全流程(15 靶点 14 命中、纯度 96.4%)仍是本期唯一重大兑现,今日无跨厂复现或 toolchain 开放的新证据。
- 证据:[上期 T-137]|[科研 agent 闭环]|(见 2026-08-19 报告)
- 还卡在哪:科研闭环仅 Anthropic 单厂演示,缺跨厂独立复现与 toolchain 开放。
- 别高兴太早:仍是单厂演示,没到"事实标准"那条线。
v-cost(推理成本与小模型)—— 档位:收敛中
- 实验室侧(中国 AI 云收入实锤):阿里截至 2026-6-30 季度 AI 云与算力服务收入 484.37 亿元人民币、同比加速至 +45%,AI 相关产品收入连续第十二个季度三位数同比增长;资本开支同比大幅扩张,把"收租化 + 竞争性降价"再压实一层。
- 证据:[金十电报]|[阿里业绩]|查看原文
- 开源侧:Liquid LFM2.5 / Unsloth Qwen3.8 量化继续压低端侧与边缘部署成本(见 v-openflagship)。
- 还卡在哪:收租化 30 天内第二家跟进仍未见;竞品(Fable 5 / Gemini / xAI)跟降信号暂无。
v-security(企业 agent 数据安全与信任)—— 档位:收敛中(事实标准候选高位子态)
- 实验室侧(今日最强增量之一):OpenAI 重申面向合格 API 客户的 Zero Data Retention(ZDR),并预告 Private Safety Processing——跨交互识别风险、不向人员暴露客户内容,计划 9 月出白皮书;同时因 Astra 模型可能达"关键网络安全能力阈值",暂停最新模型两周 RL 训练、加强工作负载隔离 / 网络隔离 / 思维链监控(→T-138)。
- 关系判断:OpenAI 把"零数据保留"推到前沿模型、又主动暂停训练两周,与 Anthropic 的 30 天保留形成对照,安全 / 信任攻防三面(数据保留 / 训练暂停 / 沙箱隔离)同日闭合。
- 还卡在哪:企业 MCP 数据安全机制未获独立审计认可;去水印军备继续升温。
v-skills(agent 技能与 harness 标准)—— 档位:收敛中
- 开源侧(本轮最强单日信号):GitHub Trending 同日涌进一批 agent 框架 / 沙箱——obra/superpowers(agentic skills 框架 + 软件开发方法论,27.5 万 star,MIT)、火山 OpenViking(自进化上下文数据库,统一记忆 / RAG / Skills,3 万 star,AGPL)、OneCLI(开源沙箱 agent harness,给每个员工一个安全个人 agent,3.2k star,Apache-2.0)、BrightbeamAI/CHAP(Collaborative Human Agent Protocol,61 star,Apache-2.0);Simon Willison 实测 smolmachines / smolvm 做不可信 Python / JS 沙箱(限 RAM / CPU、无网、仅指定文件)。Claude Code v2.1.236 加 ANTHROPIC_DEFAULT_MODEL 环境变量(新会话默认模型,/model 仍可覆盖并跨重启保留)+ 跨会话闲置通知。
- 关系判断:技能 / 沙箱方向单日聚类 ≥5 个独立项目,是
v-skills本轮跟踪以来最密的一波,但仍是"有人在试",没到"标准化落地"。 - 还卡在哪:技能质量参差;harness 标准化仍靠大厂落地。
v-memory(记忆可靠性)—— 档位:实验
- 今日无新增跨 agent 长期记忆的标准化证据,维持实验档。
v-embodied(具身智能 / 机器人 agent)—— 档位:实验
- 今日无新证据。边界观察(AC-004):模型自改进 / RSI 与具身智能连续 11 天维持实验档,复现缺口未解、无 regime 漂移实证,继续 early-warning,不触发框架换代。
横轴 · 渗透率
- f-knowledgework(企业知识工作 / AI 办公) —— 档位:早期采用
- f-devagent(开发者 agent 入口) —— 档位:早期采用
- f-caros(端侧 / 可穿戴 AI 入口) —— 档位:萌芽
- f-chinastack(中国 AI 全栈) —— 档位:早期采用
资本与政策
- Stripe 签署协议收购 OpenRouter:模型网关 / 路由平台被支付巨头收编,路由层(routing / MaaS)出现收租化 + 分发格局整合信号;OpenRouter 称名称、产品、路线图不变、路由仍以用户最佳为驱动。
- 证据:[OpenRouter 官方博客]|[收购公告 8/19]|查看原文
- 阿里 Q1(截至 6/30)AI 云与算力服务收入 484.37 亿元、同比加速至 +45%:AI 相关产品连续第十二个季度三位数同比增长,资本开支同比大幅扩张——中国 AI 云需求实质兑现的硬财务信号(→v-cost / T-121)。
- 证据:[金十电报]|[阿里业绩]|查看原文
- Anthropic Q2 收入据称首超 OpenAI(单源转述,待官方):据 WSJ(Juya 转述),Anthropic 二季度收入 116 亿美元、首超 OpenAI 的 67 亿美元、已小幅营业盈利;属单源转述,vendor 动态以官方源校验,不作框架硬证据。
- 证据:[Juya AI Daily 转述]|[WSJ 口径]|查看原文
- OpenAI 下周把 ChatGPT Ads 扩至 31 个欧洲市场:从原 8 个试点扩到德 / 法 / 西 / 意等 31 个市场,仅向 Free / Go 用户展示,Plus / Pro / Enterprise 无广告——变现入口扩张。
- 证据:[Juya AI Daily]|[ChatGPT Ads]|查看原文
待跟踪 & 本期变更
未来 24-72h 待跟踪(watchboard 投影;矢量 / 形态用 canonical id 引用):
| 待印证的能力矢量(纵轴) | 待观察的渗透(横轴) | 待发布动作 / 待验证项目 |
|---|---|---|
| v-openflagship:DeepSeek V4 Pro 0813 权重 8/24 是否放出(候选①) | f-knowledgework:Codex 2000万周活后留存与企业采用 | Anthropic Model 2 官方确认(T-135,8/21) |
| v-openflagship:GLM-5.3 权重 8/28 是否放开(候选② / T-136) | f-chinastack:阿里 AI 云收入兑现后的中报季外溢 | DeepSeek V4 Pro 权重官宣与 HF 页(候选①,8/24) |
| v-security:OpenAI 暂停训练两周后是否恢复、竞品是否跟放缓(T-138,9/2) | f-caros:Meta AI Mac 桌面入口 DAU 信号 | GLM-5.3 权重放开与智谱官方页(候选②,8/28) |
| v-longtask:Claude 蛋白设计闭环跨厂独立复现(T-137,8/29) | 暂无明确预期 | — |
🔄 本期变更(框架 × 跟踪合并)
- 框架:两轴矢量 / 渗透档位均沿用,11 个 open 项顺延;
v-skills获本轮最强单日信号(agent 框架 / 沙箱 obra superpowers / OpenViking / OneCLI / CHAP / smolvm + Claude Code 工具链)、v-security同步吃下 OpenAI ZDR + 暂停前沿训练两周,能力侧两线继续垫厚,仍无档位跨档(←frame_change)。 - 跟踪项结算(上期每个 open 项均经处理,无凭空消失):
#T-116(v-openflagship)GLM-5.3 官验仍待 8/28、Qwen3.8-27B 已毕业为 established、DeepSeek V4 Pro 权重仍卡 8/24 → 顺延;子项#T-136(GLM-5.3 8/28 官验)→ 顺延。#T-121(v-cost)阿里今日 AI 云 +45% 是 v-cost 硬财务信号但非结算点、Etched 融资(子#T-139)→ 顺延。#T-125(v-skills)今日 GitHub Trending agent 框架爆发是 v-skills 最强单日信号,但仍收敛中 → 顺延。#T-126(v-skills)harness 标准化 / 浏览器 MCP 今日无新(Anthropic TSC 未动)→ 顺延。#T-127(v-openflagship)字节 Seed 4 部门、蚂蚁 Ling 开源、Ornith / GLM 持续有动作 → 顺延。#T-131(v-cost,已 confirmed)GPT-5.6 Sol 半价把定价战从开源烧到闭源前沿,结案维持 confirmed。#T-132(v-security)OpenAI ZDR + Private Safety Processing + 暂停前沿训练两周 → v-security 强信号,但企业 MCP 审计 / 去水印军备未解 → 顺延;子项#T-138(OpenAI 暂停训练两周)→ 顺延。#T-133(v-openflagship)端侧 / 国产 AI 硬件财务验证今日无中报信号 → 顺延。#T-134(v-cost)GPT-5.6 Sol 半价后连锁——OpenAI ZDR 非跟降、竞品跟降仍无 → 顺延。#T-135(v-openflagship)Anthropic Model 2 官方确认窗口 8/21 未到 → 顺延。#T-137(v-longtask)Claude 蛋白设计闭环今日无跨厂复现 / toolchain 开放 → 顺延。
- 新开:本期无新增 open 跟踪项(候选与重点均未毕业,预算 2/2 占满,open 数已达软上限 10,按母题归并原则不新开)。watch_companies 增补 OpenRouter / Stripe(路由层 M&A 观察)。
- 框架体检:距上次 review 12 天触发到期,对照三条 invalidation_trigger 全未命中,regime 维持"稳定",AC-004 边界观察连续 11 天维持实验档、无 regime 漂移实证(见 framework_state 2026-08-20)。