更新时间:18:30|覆盖窗口:2026-08-18 ~ 08-19(承接上一期 2026-08-18)
数据来源:GitHub Trending / Product Hunt / Hacker News / RSS(OpenAI / Anthropic / Google AI / Meta AI / DeepMind / HuggingFace / Mistral / NVIDIA / The Decoder / Juya / AI Hot 等)/ 金十电报
数据覆盖与缺口(抓取失败 / enrichment 缺失在"状态"列标注,不展开成段落):
| 源 | 入库数 | 状态 |
|---|---|---|
| Product Hunt | 4 | ✓ |
| Hacker News | 0 | ✗ 抓取失败(连接超时,已重试未果)——真实缺口,本期 HN 信号缺位 |
| GitHub Trending | 13 | ✓ |
| RSS | 57 | 部分 feed 失败(Google AI / HuggingFace / NVIDIA / Microsoft AI / 多个 YouTube / 多数 Newsletter 当日 0 条;Juya RSS 当日 0 条 → 源站直抓补齐 daily.juya.uk/issues/2026-08-19/,24 条) |
| 金十电报 | 210 | ✓(AI 相关占比低,已按主题过滤) |
这份日报是一张二维坐标系:纵轴看模型与产品的能力 / 技术往哪走(实验→收敛中→事实标准,判档看证据强度,同一矢量当天 ≥2 个独立证据才算收敛),横轴看 AI 产品被多少人、多少场景真用上(萌芽→早期采用→主流化,判档看真实使用信号,不看 star / votes)。
一句话结论
地图今天动了两格:开放旗舰侧智谱 GLM-5.3 上线、Artificial Analysis 智能指数 60 追平 Kimi K3 登顶开源,把中国开放模型的"可用度"又顶高了一档(→候选②);长任务可靠侧 Claude 自主跑完蛋白质设计全流程(15 靶点 14 命中、纯度 96.4%),是 agent 在真实科研闭环里最像"坐庄"的一次兑现(→纵轴 v-longtask)。能力侧在"能做什么"上双线突破,但渗透侧仍是企业和开发者两拨人先动,普通用户入口只有零星动作(Gemini in Chrome、豆包虚拟桌面、ChatGPT for Teens)。今天没有新 S-confirmed——Qwen3.8-27B 毕业为 established 锚点、腾出候选名额;重点候选 2 席维持(DeepSeek V4 Pro 0813 + GLM-5.3),预算 2/2。接下来两天盯三件事:DeepSeek V4 Pro 0813 权重 8/24 是否真放(候选①验证点)、GLM-5.3 智谱官方页与 8/28 权重节点是否如期(候选②)、OpenAI 暂停前沿训练两周后是否恢复、竞品是否跟放缓。
重点候选 · 待验证
与 S-confirmed 合计不超过 2 个;本期 S-confirmed 0 席(→无「今日重点·深度拆解」节),候选 2 席占满预算 2/2。候选全文只在这里展开,纵 / 横轴只留指针。
① DeepSeek V4 Pro 0813 + Harness —— 重点候选,尚缺官方可下载权重
- 为什么重要:命中候选触发条件①(重点厂商旗舰级新一代基础模型 + 重大开放权重重构)。DeepSeek 是本轮开放权重双旗舰之一,V4 Pro 0813 若放出可下载权重,将把 v-openflagship 的"开放度"从"能调用 API"再推一层。
- 确认阻断项:V4 Pro 0813 权重 8/24 节点未到、尚无官方可下载权重页;今日仅见 V4-Pro 在 3D 编码测试中的 token 消耗信号(耗 token 达 Muse 48 倍),未改变"权重未放"状态。
- 下一步验证:8/24 前后看 HF 权重页与官方 model card 是否落地(→ T-116)。
- 已有证据:[AIHot·DeepSeek V4 Flash 自验证]|查看原文;[AIHot·V4-Pro 3D 编码测试]|查看原文
② GLM-5.3(智谱)—— 重点候选,尚缺官方页与独立复核
- 为什么重要:命中候选触发条件①(重点厂商旗舰级新一代基础模型 + 重大开放权重重构)。智谱上线 GLM-5.3 API,Artificial Analysis 智能指数 60、追平 Kimi K3 登顶开源,把本轮中国开放模型的"可用度"顶到新档;与 Qwen3.8-27B、DeepSeek V4-Flash 共同把开放权重阵营往前推一格。
- 确认阻断项:以第三方转述( AIHot / Juya )+ API 上线为主,缺智谱官方 model card / 可下载权重页;OpenRouter 具体模型页未解析到;独立 benchmark 复核待补。
- 下一步验证:智谱官方页核实 + 8/28 权重节点是否如期放开(→ T-136)。
- 已有证据:[AIHot·GLM-5.3 发布登顶开源]|查看原文;[AIHot·GLM-5.3 上线 OpenRouter]|查看原文;[Juya AI 早报·GLM-5.3 API]|查看原文
纵轴 · 能力与技术演进
实验室侧与开源侧证据并到同一条矢量上讲;同一矢量当天 ≥2 独立证据才判收敛。
- v-openflagship(开放权重 / 开源旗舰)—— 档位:收敛中
- 实验室 / 开源侧:GLM-5.3(智谱)上线 API,Artificial Analysis 智能指数 60、追平 Kimi K3 登顶开源(→候选②);Qwen3.8-27B 毕业为 established 锚点——本地可跑追平 GPT-5.6 的实测持续出现,开放侧"可用"垫厚;Grok 4.6 在 DiligenceBench 金融评测位列第二、与 Claude Opus 5 持平。
- 还卡在哪(open_pain):跨厂完整可比评测缺;GLM-5.3 官方 model card / 权重页待核、V4 Pro 0813 权重 8/24 节点未到(→候选①)。
- 别高兴太早:GLM-5.3 以第三方转述 + API 上线为主,独立 benchmark 复核待补,暂不能算开放侧"坐实登顶"。
- v-longtask(长任务可靠性)—— 档位:收敛中
- 实验室侧:Claude 自主完成计算蛋白质设计全流程——设计蛋白结合剂 15 靶点 14 命中、处理 NMR / LC-MS 纯度 96.4% 近实验室值,从设计到分析化学形成闭环(Anthropic,AIHot + Juya 双源);这是 test-time scaling 在真实长任务基准之外、第一次落到科研生产闭环的兑现。
- 开源侧:DeepSeek V4 Flash 自验证(Terminal-Bench 2.1 79%→88%)仍是同方向证据(→候选①)。
- 还卡在哪:科研闭环仅 Anthropic 单厂演示,缺跨厂独立复现与 toolchain 开放(→ T-137)。
- v-cost(推理成本与小模型)—— 档位:收敛中
- v-security(企业 agent 数据安全与信任)—— 档位:收敛中
- v-skills(agent 技能与 harness 标准)—— 档位:收敛中
- 开源侧:企业微信 5.0.10 开放 CLI + MCP(Juya 确认不限企业规模),WorkBuddy、Codex、DeepSeek Harness 等可直接调十大办公模块;Claude Tag 任 Anthropic CI/CD 一线值班(中位 14 分钟,人类仍负审批);Remotion Skills 2.0 支持 Sub-skills。OpenViking(字节)上下文数据库 for agents、ai-memory 跨 agent 长期记忆同日涌现。
- 还卡在哪:技能质量参差,harness 标准化仍靠大厂落地验证。
- v-memory(记忆可靠性)—— 档位:实验
- 开源侧:akitaonrails/ai-memory——"跨 Claude Code / Codex 续任务不重述架构、失败路径与开放问题",是跨 agent 长期记忆的单点样本,尚无标准。
- 证据:[GitHub·ai-memory]|查看原文
- 开源侧:akitaonrails/ai-memory——"跨 Claude Code / Codex 续任务不重述架构、失败路径与开放问题",是跨 agent 长期记忆的单点样本,尚无标准。
- v-embodied(具身智能 / 机器人 agent)—— 档位:实验
- 今日无强信号,单点 demo 未跨厂复现。
横轴 · 渗透率
没有新变化就直说;今天渗透侧是真有动作的一天,但入口仍集中在企业 / 开发者。
- 企业知识工作 / AI 办公(f-knowledgework)—— 档位:早期采用
- 开发者 agent 入口(f-devagent)—— 档位:早期采用
- MiniMax 发布 MiniMax Code CLI(公测,macOS/Linux/Windows);Vercel fx(Zig 编写 coding agent,冷启动 10µs);Cursor 推 Origin 代码托管;Claude Code 周上限 +50% 延至 8/31;Mojo 编译器与工具链以 Apache 2 开源(Modular,Simon Willison 确认)。载体:IDE / 终端。
- 用户段:开发者|copilot→有监督。
- 端侧 / 可穿戴 AI 入口(f-caros)—— 档位:萌芽
- Gemini in Chrome 面向美国 Android 开放(auto browse 代理);豆包 Windows 虚拟桌面(授权操作电脑界面);ChatGPT for Teens 默认青少年保护。均无 DAU 信号。
- 中国 AI 全栈(f-chinastack)—— 档位:早期采用
- GLM-5.3 + MiniMax Code + 豆包虚拟桌面 + 千问高校岗位——模型 + 应用侧持续有动作,全栈渗透延续。
资本与政策
- Etched 完成 7 亿美元融资(估值 210 亿,Jane Street 领投并收首机架):AI 芯片资本热度继续升温,专用推理芯片路线获重量级背书。
- 证据:[Juya AI 早报·Etched 融资]|查看原文
- OpenAI 暂停最大规模前沿 RL 训练两周以强化安全:模型 Astra 临近网络能力阈值,安全节奏主动调整,非版本换代。
- 证据:[The Decoder·OpenAI pacing]|查看原文
- 欧洲央行警告 AI 投资过热:称泡沫一旦破裂或冲击全球经济,宏观风险信号。
- 证据:[AIHot·欧洲央行警告]|查看原文
- Anthropic 拟向 CEO Amodei 等发额外投票权股(隔绝外压,未官确):治理层动作。
- 证据:[AIHot·Anthropic 投票权]|查看原文
- 谷歌 1000 万美元购破产航司 Spirit 数据训模型:数据资产收并购延续。
- 证据:[Juya AI 早报·谷歌购 Spirit 数据]|查看原文
待跟踪 & 本期变更
未来 24-72h 待跟踪(矢量 / 形态 / 待发布 三栏,canonical id 引用):
| 待印证的能力矢量(纵轴) | 待观察的渗透(横轴) | 待发布动作 / 待验证项目 |
|---|---|---|
| v-openflagship:DeepSeek V4 Pro 0813 权重 8/24 是否真放;GLM-5.3 官方页与 8/28 权重节点 | f-knowledgework:企业微信 / Claude 真实企业采用量 | OpenAI 暂停前沿训练两周后是否恢复、竞品是否跟放缓(T-138) |
| v-longtask:Claude 蛋白设计闭环是否获跨厂独立复现(T-137) | f-devagent:Vercel fx / MiniMax Code / Mojo 真实开发者采用 | Anthropic Model 2 官方确认 / 否认(T-135,8/21 窗口) |
| v-cost:收租化 30 天内第二家跟进(T-134) | f-caros:Gemini in Chrome / 豆包虚拟桌面 DAU 信号 | GLM-5.3 智谱官验与 8/28 权重(T-136) |
🔄 本期变更(框架 × 跟踪合并)
- 框架(两轴矢量 7 项顺延;方向性变更 2 处):① v-openflagship 新增顶流——GLM-5.3 上线登顶开源(Qwen3.8-27B 毕业为 established 锚点腾出候选名额,← 一句话结论 + 候选②);② v-longtask 重大兑现——Claude 自主蛋白质设计全流程(15 靶点 14 命中,← 纵轴 v-longtask)。
- 跟踪项结算(9 个 open 逐条碰一次,四选一不凭空消失):#T-116/127/133 无新档位进展,顺延(开放旗舰 GLM-5.3 新证据垫厚、中国全栈 MiniMax Code / 千问岗位持续);#T-121 顺延(无新资本开支信号,Etched 融资另开 T-139);#T-125 顺延(Juya 确认企业微信 5.0.10 不限规模开放 CLI+MCP);#T-126 顺延(8/19 Anthropic TSC 节点未到);#T-132 顺延(OpenAI 新安全政策 + 水印军备,信任面攻防继续);#T-134 顺延(OpenAI 暂停训练两周 ≠ 跟降,竞品跟降信号暂无);#T-135 顺延(8/21 Model 2 官方窗口未到);#T-131 维持 confirmed。
- 新开:#T-136(v-openflagship)GLM-5.3 官验与 8/28 权重——收为 T-116 子项;#T-137(v-longtask)Claude 蛋白质设计闭环——新开顶层;#T-138(v-security)OpenAI 暂停前沿训练两周——收为 T-132 子项;#T-139(v-cost)Etched 7 亿融资——收为 T-121 子项。
- 候选:#S-candidate① DeepSeek V4 Pro 0813 + Harness(维持,阻断 = 权重 8/24 未放);#S-candidate② GLM-5.3(新,阻断 = 官方 model card / 权重页 + 独立复核待补)。S-confirmed 0 席 → 无「今日重点·深度拆解」节。