更新时间:16:00|覆盖窗口:2026-08-17 ~ 08-18(承接上一期 2026-08-17)
数据来源:GitHub Trending / Product Hunt / Hacker News / RSS(OpenAI / Anthropic / Google AI / Meta AI / DeepMind / HuggingFace / Mistral / NVIDIA / The Decoder / Juya / AI Hot 等)/ 金十电报
数据覆盖与缺口(CLS 不采集属设计、非缺口;Juya 当日 RSS 采集失败、已源站直抓补齐 daily.juya.uk/issues/2026-08-18/):
| 源 | 入库数 | 状态 |
|---|---|---|
| Product Hunt | 20 | ✓ |
| Hacker News | 27 | ✓ |
| GitHub Trending | 11 | ✓(元数据 6/11 抓取失败,趋势条目已入库) |
| RSS | 50 | 部分 feed 失败(Simon Willison / Stratechery / Daniel Miessler / One Useful Thing / YouTube·AI 等 SSL/连接中断,按降级标注) |
| 金十电报 | 206 | ✓ |
这份日报是一张二维坐标系:纵轴看模型与产品的能力 / 技术往哪走(实验→收敛中→事实标准,判档看证据强度,同一矢量当天 ≥2 个独立证据才算收敛),横轴看 AI 产品被多少人、多少场景真用上(萌芽→早期采用→主流化,判档看真实使用信号,不看 star / votes)。
一句话结论
地图今天没跨档,但 v-cost 出现了本轮最明确的一次降价共振——OpenAI 最强模型 GPT-5.6 Sol 在 OpenRouter 和 Vercel 同时半价,定价战从国产开源烧到了闭源前沿;同天开源阵营(Qwen3.8-27B、DeepSeek V4 Flash)继续把"可用"垫厚,企业微信把 MCP+CLI 向所有企业敞开,agent 入口在中国企业协作栈里又扎深了一层。今天没有新 S-confirmed(Qwen3.8-27B 已于 08-17 毕业,本期只做轴内延续),定级 2 席维持:Qwen3.8-27B S-confirmed + DeepSeek V4 Pro 0813 + Harness S-candidate,预算 2/2 占满;GPT-5.6 Sol 半价不占定级名额,作为 v-cost 定价战关键证据促成 T-131 结案、新开 T-134 盯竞品跟降。接下来两天盯两件事:DeepSeek V4 Pro 0813 权重 8/24 是否真放(候选①验证点),以及 GPT-5.6 Sol 半价会不会逼 Claude/Gemini 跟降(定价战从单点变结构的信号)。
重点候选 · 待验证
与 S-confirmed 合计不超过 2 个;本期定级 2 席维持(Qwen3.8-27B S-confirmed + DeepSeek V4 Pro 0813 + Harness S-candidate),预算 2/2 占满,故候选仅 1 席;GPT-5.6 Sol 半价以非候选观察形式附于其下。候选全文只在这里展开,纵 / 横轴只留指针。
① DeepSeek V4 Pro 0813 + Harness —— 重点候选,尚缺官方可下载权重
- 为什么重要:命中候选触发条件①(重点厂商旗舰级新一代基础模型 + 重大开放权重重构)。DeepSeek 是本轮开放权重双旗舰之一,V4 Pro 0813 若放出可下载权重,将把 v-openflagship 的"开放度"从"能调用 API"再推一层。
- 确认阻断项:V4 Pro 0813 权重 8/17 未如期开放、已顺延至 8/24;DSH(DeepSeek Harness)官方表述"变化≠正式版本",确认非正式发布。今日无新权重官宣。
- 下一步验证:8/24 前后看 HF 权重页与官方 model card 是否落地(→ T-116)。
- 已有证据:[AIHot·DeepSeek V4 Flash 自验证]|[第三方转述,Stanford 用 V4 Flash 自评把 Terminal-Bench 2.1 从 79% 提至 88%]|查看原文;[OpenRouter·DeepSeek 峰谷定价说明]|[官方定价页]|查看原文
② GPT-5.6 Sol 半价 —— 非候选重点观察(v-cost 定价战结构性证据)
- 为何不立候选:定级预算 2/2 占满(Qwen3.8-27B S-confirmed + DeepSeek V4 Pro 0813 S-candidate);且半价属 v-cost 单维事件,未触发能力 / 开放性跨维变化,不足以单独占据定级名额。
- 事件:OpenRouter 把 OpenAI 当前最强模型 GPT-5.6 Sol 调用费直接砍半,输入 $2.5 / 输出 $15(每百万 token),Vercel AI Gateway 同步限时半价至 9/18——定价战第一次从国产开源(DeepSeek 涨价 / 收租)明确烧到闭源前沿模型,T-131(定价战结构性验证)据此结案为 confirmed。
- 下一步验证:未来 1-2 周看 Claude / Gemini 是否跟降(→ 新开 T-134)。
- 已有证据:[AIHot·IT之家]|[OpenRouter 下调 GPT-5.6 Sol 调用费 50%]|查看原文;[OpenRouter 官方定价页]|[GPT-5.6 Sol API Pricing]|查看原文;[Juya AI 早报]|[GPT-5.6 Sol 半价登陆 OpenRouter 与 Vercel AI Gateway]|查看原文
纵轴 · 能力与技术演进
实验室侧与开源侧证据并到同一条矢量上讲;同一矢量当天 ≥2 独立证据才判收敛。
- v-openflagship(开放权重 / 开源旗舰)—— 档位:收敛中
- 实验室 / 开源侧:Qwen3.8-27B 仍在积累——Qwen 官方称其"强到跟上前沿、轻到笔记本可跑",Artificial Analysis 给到 52 分(HN 当日条目),本地可跑追平 GPT-5.6 的多篇实测持续出现;DeepSeek V4 Flash 自验证把 Terminal-Bench 2.1 从 79% 推到 88%、成本仅 Claude Fable 5 的 1/11,框架已开源可复现(→ 候选① 同厂信号)。Grok 4.6 在 MedAgentBench(临床 EHR agent 基准)以约 95.9% pass@1 登顶,超 GPT-5.6 Sol 的 94.7%。
- 还卡在哪(open_pain):Qwen3.8-Max 真旗舰权重仍待放、跨厂完整可比评测缺;V4 Pro 0813 权重 8/24 节点未到。
- 别高兴太早:Anthropic 风险报告提及未发布的 Model 2 略优于公开最强 Claude Mythos 5(AIHot·IT之家单源转述,无官方页,按 A 级登记、待官方确认)。
- v-cost(推理成本与小模型)—— 档位:收敛中
- v-security(企业 agent 数据安全与信任)—— 档位:收敛中
- v-skills(agent 技能与 harness 标准)—— 档位:收敛中
- 开源侧:企业微信 5.0.10 向所有规模企业开放 CLI + MCP,WorkBuddy、DeepSeek Harness、Minimax Code 等主流 agent 可直接调文档 / 表格 / 邮件 / 会议等十大办公模块;ElevenLabs MCP 接入 Claude(Product Hunt),Agent Plugins 生态继续长(→ f-knowledgework)。
- 还卡在哪:技能质量参差("agent 技能反而可能更差"),harness 标准化仍靠大厂落地验证。
- v-longtask(长任务可靠性)—— 档位:收敛中
- 开源侧:DeepSeek V4 Flash 的自验证(采样多答案 + 自评)把 Terminal-Bench 2.1 显著提升,是 test-time scaling 在一次真实长任务基准上的兑现(→ v-openflagship 同源信号)。
- v-embodied(具身智能 / 机器人 agent)—— 档位:实验
- 实验室侧:共生知行发布人形机器人驾驶卡丁车 Demo,展示"直接感知—控制"端到端模型(单点,未跨厂复现)。
- v-memory(记忆可靠性)—— 档位:实验
- 实验室侧:研究揭示 LLM 智能体记忆机制存在重大盲区(AIHot 转述),跨厂记忆审计 / 遗忘规范仍缺。
横轴 · 渗透率
没有新变化就直说;今天渗透侧是真有动作的一天。
- 企业知识工作 / AI 办公(f-knowledgework)—— 档位:早期采用
- 开发者 agent 入口(f-devagent)—— 档位:早期采用
- Claude Code 上线
/design功能(Juya)、Cursor 推出 Origin 代码托管平台早期测试版——开发者的 agent 工作流继续向"写代码 + 管仓库"收口。
- Claude Code 上线
- 端侧 / 可穿戴 AI 入口(f-caros)—— 档位:萌芽
- 雷鸟 iO 系列官宣 8/21 发布"人类增强 AI 眼镜",仍处发布前预热,无 DAU 信号。
资本与政策
- OpenAI × PORTS-Pike 数据中心容量协议:初期部署预计 4.25 吉瓦(Juya 早报),资本开支继续向算力基础设施倾注。
- 证据:[Juya AI 早报·PORTS-Pike 4.25GW]|查看原文
- NVIDIA 披露 $21B SpaceX 股权(Ars Technica)—— 算力龙头向外延基础设施下注。
- 证据:[Ars Technica]|查看原文
- 寒武纪 6.9 亿元股权激励:124 名核心员工人均账面收益超 557 万元,国产 AI 芯片资本动作延续(→ v-openflagship / 中国全栈)。
- 证据:[AIHot·寒武纪股权激励]|查看原文
- Arm 战略转型:成立 36 年首次自研芯片,从指令集授权走向交付成品。
- 证据:[AIHot·Arm 自研芯片]|查看原文
- 赛昉科技推出服务器级 RISC-V HPC CPU IP 昉·天枢-100,国产算力底座继续补位。
- 证据:[AIHot·赛昉 RISC-V HPC]|查看原文
- Micron / SK 海力士承诺数十亿美元扩内存产能,但几乎全部落在 2028 年之后(storagereview)—— 短期供给瓶颈未解。
- 证据:[StorageReview]|查看原文
待跟踪 & 本期变更
未来 24-72h 待跟踪(矢量 / 形态 / 待发布 三栏,canonical id 引用):
| 待印证的能力矢量(纵轴) | 待观察的渗透(横轴) | 待发布动作 / 待验证项目 |
|---|---|---|
| v-openflagship:DeepSeek V4 Pro 0813 权重 8/24 是否真放 | f-knowledgework:千问办公 / 企业微信 MCP 真实企业采用量 | GPT-5.6 Sol 半价是否逼 Claude/Gemini 跟降(→ T-134) |
| v-cost:收租化 30 天内是否第二家跟进 | f-devagent:Cursor Origin / Claude Code /design 采用信号 | GLM-5.3 权重 8/28 能否如期放开 |
| v-security:企业 MCP 数据安全机制是否被独立审计认可 | f-caros:雷鸟 iO AI 眼镜 8/21 发布实测 | Anthropic Model 2 是否官宣(待官方) |
🔄 本期变更(框架 × 跟踪合并)
- 框架(两轴矢量 / 渗透沿用,8 项顺延;方向性变更 2 处):① v-cost 降价共振——GPT-5.6 Sol 在 OpenRouter 与 Vercel 双半价,定价战从开源蔓延到闭源前沿(← 一句话结论 + T-131 结案);② f-knowledgework 企业化落地——千问办公接入企微 + 企业微信 5.0.10 开放 CLI+MCP,agent 入口在中国企业协作栈再扎深(← 横轴 f-knowledgework)。
- 跟踪项结算(8 个 open 逐条结算,四选一不凭空消失):
- #T-131 结案 confirmed——GPT-5.6 Sol 在 OpenRouter 与 Vercel 双半价坐实"定价战从开源烧到闭源前沿",结构性验证成立;收租化部分并入新开 T-134 继续观察。
- #T-116 / T-127 / T-133 无新档位进展,顺延(开源旗舰持续垫厚、中国全栈硬件资本动作延续)。
- #T-121 顺延——PORTS-Pike 4.25GW 数据中心协议,基建扩张未减速、财务回报验证待中报季。
- #T-125 / T-126 顺延——企业微信 5.0.10 开放 CLI+MCP、千问办公接入企微,入口移动化 / harness 标准化再获落地。
- #T-132 顺延——OpenAI 布罗克曼企业 AI 威胁 10 件事 + 企业微信 MCP 数据安全机制,信任面攻防继续。
- 新开:#T-134(v-cost)GPT-5.6 Sol 半价连锁反应——竞品是否跟降、收租化条款是否扩展至闭源大厂(T-131 结案衍生);#T-135(v-openflagship)Anthropic Model 2 披露待官方验证(单源转述,短窗口 8/21)。
- 候选:#S-confirmed Qwen3.8-27B(维持,轴内延续);#S-candidate① DeepSeek V4 Pro 0813 + Harness(沿用,阻断=权重 8/24 未放)。预算 2/2 占满,GPT-5.6 Sol 半价不立候选、落 T-134 观察。S-confirmed 无新增,故无「今日重点·深度拆解」节。