更新时间:18:30|覆盖窗口:2026-08-25 ~ 08-26(承接上一期 2026-08-25)
数据来源:GitHub Trending / Product Hunt / Hacker News / RSS(OpenAI / Anthropic / Google AI / Meta AI / DeepMind / HuggingFace / Mistral / NVIDIA / The Decoder / Juya / AI Hot 等)/ 金十电报
数据覆盖与缺口(抓取失败 / enrichment 缺失在"状态"列标注,不展开成段落):
| 源 | 入库数 | 状态 |
|---|---|---|
| Product Hunt | 20 | ✓ |
| Hacker News | 20 | ✓ |
| GitHub Trending | 16 | ✓ |
| RSS | 57 | ✓;OpenAI Blog / Interconnects / One Useful Thing 等 20+ feed 当日 0 条属 feed_empty 正常空返回;Juya AI Daily RSS 当日空返回,已按源站 URL 直抓 27 条并入 enrichment ✓ |
| 金十电报 | 378 | ✓(AI 相关已过滤,入库 87 条) |
| 补充检索 | 2 | ✓(openai.com 两篇官方博客经 WebFetch 直取,enrichment 侧被 403 拦,以官方正文补正) |
这份日报是一张二维坐标系:纵轴看模型与产品的能力 / 技术往哪走(实验→收敛中→事实标准,判档看证据强度,同一矢量当天 ≥2 个独立证据才算收敛),横轴看 AI 产品被多少人、多少场景真用上(萌芽→早期采用→主流化,判档看真实使用信号,不看 star / votes)。
一句话结论
地图今天动了两格:v-cost 拿到第二股量化力量,v-memory 第一次有了产品级锚点。成本轴昨天是英伟达单方面给出 30 倍吞吐、1/35 成本的代际数字,今天 OpenAI 用自研推理芯片 Jalapeño 给出第一份非英伟达芯片的官方实测,每瓦 AI 工作量 1.5–1.9 倍于 GB200/GB300、端到端延迟低 1.7–3.6 倍,年底部署;同一天金十口径下亚马逊、苹果、微软、戴尔集体因内存成本涨价、机构预测内存紧缺持续到 2027,降本与抬升两股力继续对撞、净方向仍未定。记忆这条矢量从学术信号跨到了货架上:Anthropic 把 Claude 对话与 Cowork 的记忆统一成同一套、用户可自查自删,是 v-memory 第一次有可拆开用的产品。开放权重这边,阿里预告今晚 23:00 开源基于 Qwen4 架构的 Qwen3.8-Flash-Next,Kimi K3 与微软、亚马逊、谷歌洽谈最高 30% 收入分成,中国开放权重的商业模式第一次走到谈判桌。今天没有 S-confirmed,两个候选席位(Qwen-UI-Agent、Anthropic Platform GA)验证节点 8/28、8/29 仍未到。最该盯的是今晚 Qwen3.8-Flash-Next 权重是否如期落地,以及 8/28 GLM-5.3 权重节点。
重点候选 · 待验证
深挖预算 2/2 继续占满,与上一期一致(Qwen-UI-Agent、Anthropic Claude Platform GA 的验证节点 8/28、8/29 均未到,按 framework「节点到期只触发复查、不得凭空结业」维持候选)。本期无对象跨过 S-confirmed 四门(结构性影响 + 官方一手 + 真实可用 + 独立验证),因此不写「今日重点·深度拆解」。今日结构性最强的三条里,Jalapeño 有官方一手但缺独立复核(SemiAnalysis 的 InferenceX 是 OpenAI 自己跑的口径),Anthropic 统一记忆是产品功能级、不构成候选触发条件,Qwen3.8-Flash-Next 尚未落地,都停在候选门槛外。
① Qwen-UI-Agent(阿里通义 MAI-UI)—— 重点候选,尚缺可下载权重与第三方独立复核
- 为什么重要:命中候选触发条件①(重点厂商旗舰级新一代基础模型)。统一动作空间交错 GUI 操作与 CLI 执行、单轮批量生成动作、在线 RL 支持超 100 步轨迹、上万并行环境加速 rollout。若权重可下载且第三方复现,
v-openflagship与v-longtask会同时受推动。 - 确认阻断项:今日仍无确认可下载权重页 / HF 模型页;OSWorld-Verified、WebArena 第三方榜无同名条目。注意:阿里预告今晚 23:00 开源 Qwen3.8-Flash-Next(基于 Qwen4 架构,见纵轴 v-openflagship),属通义大模型侧动作,与 MAI-UI 的权重可得性是两条线,不互相替代,但也可能同源打通,需一并核验。
- 下一步验证:看权重是否落 HF / ModelScope、看 OSWorld-Verified 与 WebArena 是否出现同名条目、看 Qwen3.8-Flash-Next 是否与 MAI-UI 打通(→T-140,8/29)。
- 已有证据:[arXiv 一手]|[技术报告 2607.28227]|查看原文;[官方项目页]|[基准与演示]|查看原文;[GitHub 官方仓库]|[Tongyi-MAI/MAI-UI]|查看原文
② Anthropic Claude Platform GA(computer use / browser use / Skills API / Files API)—— 重点候选,一手门已过、仍缺独立采用规模
- 为什么重要:命中候选触发条件(重点厂商重大新产品线)。版本化技能与可复用文件被做成正式 API,computer use 新增 browser use 工具,Skills / Files API 同步登陆 Microsoft Foundry、computer use / browser use 即将登陆 Vertex AI。
- 确认阻断项:官方博客一手门已过,但今日仍无第三方采用规模数字或独立评测。今日 Anthropic 侧动作是记忆统一(见纵轴 v-memory,属产品功能)与 500 万美元资助计划(见资本与政策),均不构成 Platform GA 的采用规模证据。
- 下一步验证:看 Microsoft Foundry / Vertex AI 侧是否出现对应 GA 条目、看企业侧是否出现可核查采用数字(→T-142 同域,9/5)。
- 已有证据:[Anthropic 官方博客]|[四大功能 GA]|查看原文;[The Decoder]|[Claude 记忆升级:跨 Chat 与 Cowork 统一]|查看原文
纵轴 · 能力与技术演进
v-cost(推理成本与小模型)—— 档位:收敛中(第二股量化力量出现,撕裂面继续)
- 算力侧(今日最重的一条):OpenAI 公布首款自研推理芯片 Jalapeño 实测数据。额定 700W(实测持续功耗 ≤550W),用 SemiAnalysis 公共基准 InferenceX 对比 GB200(1200W)与 GB300(1400W):每瓦 AI 工作量 1.5–1.9 倍、端到端延迟低 1.7–3.6 倍、高交互工作负载 2.1–4.1 倍;在匹配延迟约束下吞吐差距最大拉开到 53.7–104 倍。测试模型含 GPT-OSS 120B、DeepSeek R1 670B 与 Kimi K2.5 1T(MXFP4)。年底在自用基础设施部署,Gen 2 深度开发中、Gen 3 成型,从设计到流片 9 个月(AI 辅助设计口径)。OpenAI 明确说"每瓦性能比每芯片性能更有意义",也明确表态仍会继续部署英伟达与合作伙伴加速器做训练与推理。这是 v-cost 撕裂了这么多天以来,第一份非英伟达芯片的官方量化数据。
- 瓶颈侧(同日反向):金十口径报道亚马逊、苹果、微软、戴尔集体涨价,机构预测全球内存紧缺或持续至 2027 年;AI 算力需求把存储芯片价格推高,上游压力向下游终端传导(Echo 入门款涨幅最高)。与 8/25 的 HBM4 缩水、英伟达七连跌连成同一条线:抬升侧证据继续加厚。
- 还卡在哪:Jalapeño 数据是 OpenAI 自测(SemiAnalysis InferenceX 基准,OpenAI 自己跑的口径),缺第三方独立复现与真实账单;年底部署后才谈得上生产级成本。30 倍吞吐 / 1-35 成本与 Jalapeño 1.5–1.9 倍每瓦数据都是厂商口径,净成本/任务方向仍未定(→T-143 强化,9/5;→新开 T-149)。
- 证据:[OpenAI 官方博客]|[Jalapeño 首批实测结果]|查看原文;[The Decoder]|[OpenAI 自研芯片 Jalapeño 推理基准超 Blackwell 与 Rubin]|查看原文;[金十电报]|[亚马逊苹果微软戴尔集体涨价,内存紧缺或持续至 2027]|查看原文
v-openflagship(开放权重 / 开源旗舰)—— 档位:收敛中(今晚开源 + 商业模式谈判双信号)
- 开源侧(今日最重的一条):阿里千问预告今晚 23:00 开源 Qwen3.8-Flash-Next,基于 Qwen4 架构的多模态 MoE,目前只放预告、权重未落地。这是 Qwen4 架构的首次开源预告,若如期落地,开放权重旗舰再添一员(→新开 T-152,今晚即验证)。
- 商业模式侧(新维度):知情人士称月之暗面正与微软、亚马逊、谷歌洽谈 Kimi K3 收入分成协议,允许美云厂商托管 Kimi K3,早期谈判寻求最高 30% 的收入分成——若达成,将是中国 AI 企业与美国云厂商之间的标志性商业模式(→T-144 强化)。
- 生态侧(第三方量化):Apodex 1.1 分析 221 个 MATS 项目,中国开放权重模型采用率升至 50.55%(Juya 转述口径,待一手源核验);IBM 发布开源 Granite 4.2(3B/8B/30B,企业 agentic、原生推理 + 工具调用 + 编码 + 语音),西方大厂把"开源企业 agent 模型"当成正式产品线来做。开放权重从"谁家在放权重"演进到"谁家在替它做商业模式"。
- 还卡在哪:DeepSeek V4 Pro 0813 权重 8/28 仍未放出(T-116);GLM-5.3 官方 model card 与 8/28 权重节点未到(T-136);Qwen-UI-Agent 权重可得性 8/29 未到(T-140);Kimi K3 收入分成仍在谈判、无落笔(T-144);Qwen3.8-Flash-Next 今晚验证(T-152)。
- 证据:[Juya AI Daily 源站]|[阿里千问预告今日开源 Qwen3.8-Flash-Next]|查看原文;[金十电报]|[月之暗面与美云计算巨头洽谈 Kimi K3 最高 30% 收入分成]|查看原文;[IBM Research 官方博客]|[Granite 4.2 面向企业 agent 的原生推理]|查看原文
v-skills(agent 技能与 harness 标准)—— 档位:收敛中(互通从实做走向官方目录)
- 标准侧(今日最重的一条):OpenAI 推出 WebMCP——实验性开放标准,允许网站暴露结构化工具供 agent 直接使用,不必猜 UI;奖品赞助方包括 Shopify、Google Chrome、Netlify、Cloudflare、Vercel、Render,10 名获胜者各 $3000 + 一年 ChatGPT Pro,8/25 开放提交、9/3 截止。这是继 Anthropic(Skills/Files API)、MCP 生态之后,OpenAI 对"agent 如何用工具"给出的标准答案,且一次性拉上浏览器与建站平台做分发。
- 互通侧(官方目录成型):anthropics/claude-plugins-official 官方插件目录上线,分内部插件与第三方插件两级,
/plugin install <name>@claude-plugins-official即可安装——v-skills 盯了多日的"三套清单各自为政",Anthropic 侧先收敛成了官方目录(→T-142 强化)。 - 入口侧:ChatGPT Work 新增代用户登录网站能力(agent 以用户身份进受登录墙的站点);ChatGPT 浏览器扩展支持 Edge、Brave、Opera、Vivaldi;Claude Code v2.1.246 发布(修复 Bash 通配符权限等)。
- 还卡在哪:WebMCP 仍是挑战赛级实验标准、未进产品默认;官方目录的供应链安全(Anthropic 明示"无法验证插件内容,安装需自担风险")正是 T-142 的另一半;跨 agent 互通统一规范仍未出现(→T-142,9/5)。
- 证据:[OpenAI 官方页面]|[WebMCP 挑战赛]|查看原文;[GitHub 官方仓库]|[anthropics/claude-plugins-official]|查看原文;[Juya AI Daily 源站]|[ChatGPT Work 代登录网站 / WebMCP 黑客松]|查看原文
v-security(企业 agent 数据安全与信任)—— 档位:收敛中(治理工具侧出现第一个产品)
- 治理侧(今日新信号):OpenAI 面向 ChatGPT Work 与 Codex 推出 Admin 管理插件,管理员直接在对话里管理用户与权限、看活动数据与额度使用、审批额度申请、生成报告,已上线 ChatGPT Work 插件目录。企业 agent 的治理从"外部审计"走向"原生管理入口",管理员第一次能在对话里回答"谁在用什么、用了多少"。
- 边界侧(同向延续):Anthropic 统一记忆的官方博客标题就是"you decide what's in it"——记忆默认不落地、用户可查看删除,把"用户知情权"做成产品卖点(详见 v-memory)。与 OpenAI 的 Admin 治理是同一条信任曲线的两个动作。
- 还卡在哪:企业 MCP 数据安全机制仍无独立审计认可;两条数据治理路线(客户自管留存 vs 隐私计算侧检测)落地对比仍在 9/30 窗口(T-141);OpenAI 暂停前沿 RL 训练两周后是否恢复未见披露(T-138,9/2);阿拉巴马 AG 传票 OpenAI 的越狱技术报告是否公开未见下文(T-147,9/30)。
- 证据:[AI Hot]|[OpenAI 发布 ChatGPT Work 与 Codex 的 Admin 插件]|查看原文;[Anthropic 官方博客]|[Claude's memory works everywhere, and you decide what's in it]|查看原文
v-memory(记忆可靠性)—— 档位:实验(产品级锚点首次出现,仍无跨模型量化标准)
- 产品侧(今日最重的一条):Anthropic 统一 Claude 对话与 Cowork 记忆——记忆现在跨聊天、跨 Cowork 工作区生效,用户可在设置里查看、删除,默认不把内容存入外部存储、除非用户显式开启。v-memory 从"研究论文里的加权记忆树"第一次走到"货架上可拆开用、可自查自删的产品功能"。注意区分:T-148 的加权记忆树是方法研究(GAIA-Text 上 +9.97 分),Anthropic 统一记忆是产品实现,两条线独立。
- 还卡在哪:Anthropic 统一记忆是单厂产品、无跨模型基准对照;加权记忆树仍只在 GAIA-Text 单基准成立、无独立复现;跨 agent 长期记忆仍无标准(→T-148,9/15;→新开 T-150,产品侧)。
- 证据:[Anthropic 官方博客]|[Claude's memory works everywhere]|查看原文;[Juya AI Daily 源站]|[Anthropic 统一 Claude 对话与 Cowork 记忆]|查看原文
v-longtask(长任务可靠性)—— 档位:收敛中(今日无同痛点新证据)
- 今日状态:无跨厂科研闭环复现证据。Anthropic 统一记忆(跨会话长上下文)与 Apodex 1.1(自进化长任务求解,221 个 MATS 项目分析)属长任务同域但不同痛点,不构成 T-137 的收敛证据。
- 还卡在哪:Claude 计算蛋白质设计闭环(15 靶点 14 命中、纯度 96.4%)仍是单厂演示,缺跨厂独立复现与 toolchain 开放(→T-137,8/29)。
v-embodied(具身智能 / 机器人 agent)—— 档位:实验(算力侧新载体,无资本新证据)
- 算力侧:英伟达发布 Jetson Orin Nano 2 机器人计算机(2027H1 上市):与前代同外形、AI 算力 2 倍(标准模式 78 TOPS、8 核 Arm CPU + 8GB 内存),性能压到前代水平时功耗仅 15W(前代 60%)。英伟达机器人与边缘 AI 副总裁的原话是"中小型前沿模型精度已追上去年最大前沿模型,为边缘解锁实时智能"——端侧具身算力的性价比台阶,这是第一份官方规格。
- 事件侧(反差):世界人形机器人运动会举行,跑步破纪录与起火摔倒同台上演(Juya 转述)。体育化表演热度高,但产品化交付与真实使用数据仍缺。
- 还卡在哪:仍是算力载体与 demo 信号,未见产品化交付与真实使用数据;小鹏 9 亿美元融资为同源延续(→T-145,9/5)。
- 证据:[AI Hot(IT之家 RSS)]|[英伟达发布 Jetson Orin Nano 2 机器人计算机,双倍算力或四成节能]|查看原文
横轴 · 渗透率
- f-devagent(开发者 agent 入口) —— 档位:早期采用
- 载体 / 入口:IDE 扩展 / CLI / 插件目录 / 浏览器扩展
- 用户段与自主度:开发者 → 泛技术用户|copilot → 有监督
- 真实使用信号:Anthropic 官方插件目录(claude-plugins-official)上线、
/plugin install一键安装;ChatGPT 浏览器扩展新增支持 Edge / Brave / Opera / Vivaldi(浏览器入口从 Chrome 一家扩到四家);Cursor 调整计费方式与套餐额度、Command Code 宣布支持支付宝支付(国内开发者付费门槛下降);OpenAI Admin 插件让企业管理员在对话里管 Codex 用量。仍是入口侧与生态侧加厚,没有新的大众规模数字。 - 还差什么:企业级采用数字与留存仍未出;Codex 语音入口仍是直播演示、未见 GA 或用量披露(→T-125,9/5)。
- 证据:[Juya AI Daily 源站]|[Cursor 调计费 / Command Code 支持支付宝 / ChatGPT 扩展扩浏览器]|查看原文;[GitHub 官方仓库]|[claude-plugins-official 官方目录]|查看原文
- f-chinastack(中国 AI 全栈) —— 档位:早期采用
- 载体 / 入口:云 / 模型 API / 国产算力 / 办公 App / 政策
- 用户段与自主度:企业 / 专业用户|copilot → 有监督
- 真实使用信号:豆包工作正式发布(下载电脑版领 30 天订阅权益,字节把办公 agent 做成独立产品);阿里预告今晚开源 Qwen3.8-Flash-Next、千问 APP 与 PC 端工作助理支持绑定阿里云 Token Plan 额度;上海"十五五"规划点名加快端侧 AI 芯片、三维堆叠架构芯片、多形态通用智能机器人。财务侧今天给了两份公司级数字:MINIMAX 上半年收入 1.17 亿美元、同比 +283.1%,AI 原生产品收入 +100.9%,开放平台及企业服务收入 +703.1%(占总收入 63.4%);商汤上半年净利润 6.17 亿元、自上市以来首次 IFRS 口径盈利,生成式 AI 收入 23.27 亿元、+28%(→T-133 今日结案)。工业富联 ASIC AI 机柜出货量同比 +3 倍、CPO 全光交换机样机已交货。
- 还差什么:公司级财务拆分已补上(T-133 结案),下一步看端侧芯片与存储的规模出货数据(T-127,9/5)。
- 证据:[Juya AI Daily 源站]|[豆包工作正式发布]|查看原文;[金十电报]|[MINIMAX 上半年收入 1.17 亿美元同比 +283.1%,AI 原生产品 +100.9%]|查看原文;[金十电报]|[商汤上半年净利润 6.17 亿元,上市以来首次 IFRS 盈利]|查看原文;[金十电报]|[上海"十五五"规划:加快端侧 AI 芯片、三维堆叠芯片]|查看原文;[金十电报]|[工业富联:CPO 全光交换机样机已交货,ASIC AI 机柜出货 +3 倍]|查看原文
- f-knowledgework(企业知识工作 / AI 办公) —— 档位:早期采用
- 载体 / 入口:办公软件 / 插件目录 / 行业专用 agent
- 用户段与自主度:企业 / 专业用户|copilot → 有监督
- 真实使用信号:Google 发布 Gemini for Legal(企业法律版),用 MCP 连接器接 iManage、NetDocuments、DocuSign、Everlaw、RelativityOne 与汤森路透 HighQ,以及 Harvey 等专业 AI 服务,审合同、跑法律研究、跟踪监管变化,Deloitte 等伙伴直接卖成品 agent。法律这个高合规行业第一次有了官方开箱的 MCP 连接套件。OpenAI 正式推出 ChatGPT Business Premium(每席 100 美元/月,企业席位定价第一次有了明确数字)。ChatGPT Work 新增代用户登录网站能力。Anthropic 统一记忆对企业场景意味着跨会话上下文默认可用、用户可查删(详见纵轴 v-memory)。
- 还差什么:Gemini for Legal 刚发布、无采用规模数字;Business Premium 刚定价、无席位数据;企业侧留存与替代率数字仍缺。
- 证据:[The Decoder]|[Google 推出 Gemini for Legal 自动化合同与研究]|查看原文;[Juya AI Daily 源站]|[ChatGPT Business Premium 每席 100 美元 / ChatGPT Work 代登录]|查看原文
- f-caros(端侧 / 可穿戴 AI 入口) —— 档位:萌芽
- 载体 / 入口:本地 agent App / 端侧电脑
- 用户段与自主度:大众 / 专业用户|copilot → 本地自治
- 真实使用信号:Perplexity 发布本地优先 agent「Portable Computer」,端侧 27B 模型(后训练版 PPLX 27B),在真实知识工作基准上 82.6%(超开源方案 Pi 与 Hermes)、后训练版 85.4%,英伟达在 DGX Spark 上提供支持(Perplexity CEO 原话,第三方口径)。苹果发布新款 Mac mini 与 Mac Studio(M6 / M5 Ultra)。端侧载体继续上新,但都还没有规模使用数据。
- 还差什么:全部为发布 / 原型信号,无一条端侧 AI 的规模化使用或留存数据。
- 证据:[AI Hot]|[Perplexity 便携电脑智能体获英伟达支持:端侧 27B、基准 82.6%]|查看原文;[Juya AI Daily 源站]|[苹果发布新款 Mac mini 与 Mac Studio]|查看原文
资本与政策
- Kimi K3 收入分成谈判(中国开放权重商业模式首次走到谈判桌):月之暗面正与微软、亚马逊、谷歌洽谈收入分成协议,拟允许美云厂商托管 Kimi K3,早期谈判寻求最高 30% 的收入分成;若达成,将是中国 AI 企业与美国云厂商之间的标志性商业模式,也是 v-openflagship"西方云托管中国开放权重"的第一单(→T-144 强化,9/5)。
- 证据:[金十电报]|[月之暗面与美云计算巨头洽谈 Kimi K3 最高 30% 收入分成]|查看原文
- 微软 × Humain(沙特主权 AI 再落一子):微软与 Humain 宣布长期战略合作,推进沙特及更广泛地区的 AI 转型。叠加 8/25 主权 AI 韩 / 沙特 / 印度三地同日推进,主权 AI 的采购与交付节奏仍在成型(→T-146 强化,9/30)。
- 证据:[金十电报]|[微软与 Humain 达成长期战略合作]|查看原文
- 内存紧缺传导至终端(v-cost 抬升侧继续加厚):亚马逊、苹果、微软、戴尔集体涨价,机构预测全球内存紧缺或持续至 2027 年;AI 算力需求推高存储芯片价格、上游压力向下游传导(Echo 入门款涨幅最高)。与 8/25 的 HBM4 缩水、英伟达七连跌同一条线。
- 证据:[金十电报]|[亚马逊苹果微软戴尔集体涨价,内存紧缺或持续至 2027]|查看原文
- LangChain 获 Benchmark 领投 1000 万美元种子轮融资:用于支持开发者用开源框架构建数据感知的 agent 应用。agent 开源生态头部框架第一次拿到 Benchmark 级别的背书。
- 证据:[LangChain 官方博客(AI Hot 转述)]|[LangChain 获 Benchmark 领投 1000 万美元]|查看原文
- Stability AI 完成 7600 万美元 B 轮融资:图像生成侧在行业降温期仍拿到新一轮(Juya 转述口径,待一手源核验)。
- 证据:[Juya AI Daily 源站]|[Stability AI 完成 7600 万美元 B 轮]|查看原文
- Anthropic 推出 500 万美元资助计划:支持第三方在 Claude 生态上做研究与应用(Juya 转述口径)。
- 证据:[Juya AI Daily 源站]|[Anthropic 推出 500 万美元资助计划]|查看原文
- 澳大利亚推进 AI 数据中心能源新规:阿尔巴尼斯表示已获含此前反对的昆士兰州在内的地方领导人同意,目标明年出台数据中心能源使用新规。AI 基建的监管侧在澳洲先动。
- 证据:[金十电报]|[澳大利亚将推进 AI 数据中心能源新规]|查看原文
- 第三方转述 / 观点信号(Juya AI Daily,按第三方降级):OpenAI 已预训练 Bel 模型(超 10T 参数,传闻口径);传闻 OpenAI 与 Anthropic 新模型能力飞跃;Grok 4.6 上线 OpenCode Go 限时免费;商汤 SenseNova U1.5 Lite 生图模型接入 Token Plan;腾讯开源 WeMM-Embedding 多模态嵌入模型;OpenAI Build Week 获奖项目揭晓;Claude Code 坚持 CLAUDE.md 引发争议(Shopify CEO Tobi 考虑禁用)。以上均为第三方日报转述,厂商动态需以官方源核验后方可升级为事实证据。
- 证据:[Juya AI Daily 源站]|[AI 早报 2026-08-26]|查看原文
上期跟踪项结算
上一期(2026-08-25)共 19 个 open 项(含子项),逐条结算如下,无一静默消失:
| 编号 | 矢量 | 本期处置 | 依据 |
|---|---|---|---|
| T-116 | v-openflagship | 顺延强化(8/28) | DeepSeek V4 Pro 权重仍无时间表;但 Qwen3.8-Flash-Next 预告今晚开源(Qwen4 架构首开源)、Kimi K3 收入分成谈判启动,开放权重旗舰侧的"中国厂商集体动作"加厚 |
| T-136 | v-openflagship | 顺延(8/28) | GLM-5.3 官方 model card 与权重节点今日无新证据,8/28 到期再判 |
| T-140 | v-openflagship | 顺延(8/29) | Qwen-UI-Agent 权重可得性未动;今晚 Qwen3.8-Flash-Next 开源是否与 MAI-UI 打通需一并核验 |
| T-144 | v-openflagship | 顺延强化(9/5) | Kimi K3 与美云厂商谈最高 30% 收入分成(托管即采用),商业模式侧出现第一单候选 |
| T-146 | v-openflagship | 顺延强化(9/30) | 微软 × Humain 沙特战略合作落地,主权 AI 采购与交付节奏再加一地 |
| T-121 | v-cost | 顺延强化(9/5) | 内存紧缺传导至终端(四大厂涨价至 2027)→抬升侧加厚;MINIMAX / 商汤中报显示中国 AI 收入侧兑现(AI 原生产品 +100.9%、生成式 AI 收入 23.27 亿) |
| T-139 | v-cost | 顺延(9/15) | Etched 流片与客户验证今日无新证据 |
| T-125 | v-skills | 顺延(9/5) | Codex 语音入口仍无 GA 或用量披露;今日无入口侧新信号 |
| T-127 | v-openflagship | 顺延强化(9/5) | 豆包工作发布、上海"十五五"点名端侧 AI 芯片与机器人、工业富联 ASIC 机柜 +3 倍,中国全栈侧动作密集 |
| T-132 | v-security | 顺延强化(8/29) | 新增治理工具维度:OpenAI Admin 插件(对话管权限与用量);Anthropic 统一记忆主打用户可查删 |
| T-138 | v-security | 顺延(8/29→9/2) | OpenAI 是否恢复前沿 RL 训练仍未披露;今日 Admin 插件 / WebMCP 动作不断,但无训练恢复的官方口径 |
| T-141 | v-security | 顺延(9/30) | 两条数据治理路线今日无新落地对比 |
| T-133 | v-openflagship | 结案 confirmed | 中报季公司级财务信号兑现:MINIMAX 收入 +283.1%(AI 原生产品 +100.9%、开放平台 +703.1%)、商汤上市以来首次 IFRS 盈利(生成式 AI 收入 +28%)、工业富联 ASIC 机柜 +3 倍——T-133 盯的"星宸/中科创达/长鑫等公司级硬财务信号"换成了 MINIMAX/商汤/工业富联三份同等强度的公司级数字 |
| T-137 | v-longtask | 顺延(8/29) | 无蛋白闭环跨厂复现;Anthropic 统一记忆 / Apodex 1.1 属同域不同痛点 |
| T-142 | v-skills | 顺延强化(9/5) | Anthropic 官方插件目录上线(claude-plugins-official)→分发规范侧收敛出一家;WebMCP 拉到浏览器与建站平台,互通开始有官方推手;供应链安全仍明示自担风险 |
| T-143 | v-cost | 顺延强化(9/5) | 降本侧再添第二股量化力量(Jalapeño 每瓦 1.5–1.9×、延迟低 1.7–3.6×),抬升侧同步加厚(内存涨价至 2027);净方向仍未定 |
| T-145 | v-embodied | 顺延(9/5) | Jetson Orin Nano 2(78 TOPS / 15W)为算力侧新载体,非资本新证据;小鹏融资为同源延续 |
| T-148 | v-memory | 顺延(9/15) | 加权记忆树无独立复现;Anthropic 统一记忆为产品侧信号(另开 T-150),两条线独立 |
本期新开 5 项:T-149(Jalapeño 自研推理芯片,v-cost,9/30)、T-150(Anthropic 统一记忆,v-memory,9/30)、T-151(WebMCP 开放标准,v-skills,9/30)、T-152(Qwen3.8-Flash-Next 开源,v-openflagship,8/27)、T-153(Kimi K3 收入分成,v-openflagship,9/30)。
待跟踪
未来 24-72h 待跟踪(watchboard 投影;矢量 / 形态用 canonical id 引用):
| 待印证的能力矢量(纵轴) | 待观察的渗透(横轴) | 待发布动作 / 待验证项目 |
|---|---|---|
| v-cost:Jalapeño 是否有第三方独立复现或真实账单(T-149,9/30);30 倍吞吐 / 1-35 成本复现(T-143,9/5) | f-devagent:Codex 语音入口是否从直播演示走向 GA 或用量披露(T-125,9/5) | Qwen3.8-Flash-Next 今晚 23:00 权重是否如期落地(T-152,8/27) |
| v-openflagship:DeepSeek V4 Pro 权重 8/28 到期再判(T-116) | f-chinastack:端侧芯片与存储规模出货数据(T-127,9/5) | GLM-5.3 权重放开与智谱官方 model card(T-136,8/28) |
| v-openflagship:Kimi K3 收入分成是否落笔、有无第三家跟进(T-153/T-144,9/5) | f-knowledgework:Gemini for Legal 有无企业采用数字 | Qwen-UI-Agent 权重落 HF / ModelScope 与第三方榜复现(T-140,8/29) |
| v-memory:Anthropic 统一记忆能否独立评测 / 加权记忆树能否跨基准复现(T-150/T-148) | f-caros:Portable Computer 有无端侧真实使用数据 | Claude 蛋白设计闭环跨厂复现(T-137,8/29) |
| v-security:OpenAI 越狱技术报告是否公开、RL 训练是否恢复(T-147/T-138) | 主权 AI:微软 × Humain 后沙特采购节奏(T-146,9/30) | v-skills 三套清单是否收敛出互通标准(T-142,9/5) |