AlphaVault← 产业跟踪
AI 日报 | 2026-09-18 AI 日报

更新时间:19:40|覆盖窗口:2026-09-16 ~ 09-18(承接上一期 2026-09-15)
数据来源:GitHub Trending / Product Hunt / Hacker News / RSS(OpenAI / Google AI / The Decoder / AI Hot / Simon Willison / Latent Space / The Neuron 等) / 金十电报 / Juya AI Daily(feed 三天空窗,直抓 09-18 期页面回填全文)

数据覆盖与缺口:

源入库数状态
Product Hunt0✗(API token 失效,09-16 起连续三天缺数,消费产品发现面收窄,相关判断以 RSS/HN/Juya 侧证据为准)
Hacker News89✓
GitHub Trending70✓
RSS214✓(Juya feed 三天 0 条,已直抓 09-18 期 issues 页回填全文;OpenAI 官网两个页面反爬直抓失败,改经浏览器通道核验官方原文)
金十电报1268✓(09-18 仅覆盖至晨间约 06:30,此后 token 失效缺数;当日午后中国厂商动态可能漏采,相关判断已降级)
这份日报是一张二维坐标系:纵轴看模型与产品的能力 / 技术往哪走(实验→收敛中→事实标准,判档看证据强度,同一矢量当天 ≥2 个独立证据才算收敛),横轴看 AI 产品被多少人、多少场景真用上(萌芽→早期采用→主流化,判档看真实使用信号,不看 star / votes)。

一句话结论

两轴地图这个窗口动了两处:纵轴新开一条「实时语音智能体」矢量并直接落位收敛中——Google 发 3.8 Live 双版本登顶第三方语音榜、Codex 语音智能体上线、Grok Bot 补上语音、千问发了 1M 上下文的全模态 Flash,五路独立证据在同三天里攻"能边说话边干活"这同一个点;治理这条子线则从承诺真正走成了文本,OpenAI 把错配披露做成常设框架、连发六份报告,Anthropic 第一次把「Claude 主导自己 26% 的模型研发」写成公开数字(→重点①/→候选①)。供给端语音入口战与治理文本化同步发生,需求端也第一次给出企业级真实使用证据:Databricks 把 GPT-6 Astra 装给全部约 3500 名工程师,编码支出涨了 60%——供给和需求这个窗口少见地朝同一个方向使劲。接下来 72 小时盯三件事:9/20 评估者章程窗口还剩哪些文本没到(T-170/T-173)、霍奇猜想会不会有官方公告(T-166)、Astra for Law 何时开 API。

双轴定位图 · 能力成熟度 × 渗透度
2026-09-18 · 纵轴档位 + 毕业三条完成度,横轴档位 + 五追问命中数
供给超前:能力收敛了,还没人真用兑现区:能力成熟 + 真用起来需求拉动:用得广但技术没定型未挂钩实验萌芽收敛中早期采用事实标准主流化能力成熟度 ↑渗透度 →AI 音乐生成 — 渗透 萌芽|五追问 1/5|专业用户|使用信号:窗口内无新使用证据(上期 YuE2 开源后无新进展)AI 音乐生成政府/公共入口 — 渗透 萌芽|五追问 2/5|企业|使用信号:评估机制文本到货、NYC 10/5 听证会、EU 主席警告——监管颗粒度变细政府/公共入口端侧/可穿戴 AI 入口 — 渗透 萌芽|五追问 4/5|大众|使用信号:豆包手机规模化量产商用(交付≠留存);Googlebook 9/21 预购端侧/可穿戴 AI …消费级 agent 代办 — 渗透 早期采用|五追问 4/5|大众|使用信号:Muse Mac 评测反响强但留存/订阅数据缺席;Google CC waitlist;响应可视化全量消费级 agent …企业知识工作 — 渗透 早期采用|五追问 4/5|企业|使用信号:Databricks 3500 工程师全员部署 Astra(编码支出 +60%);Kimi 金融数十家机构;Harvey/Legora 采购法律 API企业知识工作中国 AI 全栈 — 渗透 早期采用|五追问 5/5|企业|使用信号:智谱十万国产卡全量生产推理;数十家金融机构用 Kimi;东盟 14 场景出海中国 AI 全栈开发者 agent 入口 — 渗透 早期采用|五追问 5/5|开发者|使用信号:Claude Code Projects 公测、Kimi Code 桌面端、TRAE 降额争议(用量承压侧面信号)开发者 agent …A. 推理成本与专用模型 — 档位 收敛中|毕业度 1/3|同档停留 ≥8 天|卡点:专用决策模型(Jev/Pareto)缺第三方复核,价格锚月度级变动AB. 长任务可靠性 — 档位 收敛中|毕业度 2/3|同档停留 ≥8 天|卡点:并行云端线程的监督与可观测工具刚起步BC. 记忆与上下文 — 档位 收敛中|毕业度 1/3|同档停留 ≥8 天|卡点:跨模型/跨产品可量化记忆增益无独立数据CD. 多智能体协作 — 档位 收敛中|毕业度 1/3|同档停留 1 天|卡点:互通协议未立,编排层产品(Radio/Pareto)采用数据缺失DE. 开放权重/开源旗舰 — 档位 收敛中|毕业度 2/3|同档停留 ≥8 天|卡点:企业生产采用仍集中在开发者入口与推理商,原生企业分发未开EF. agent 安全与信任 — 档位 收敛中|毕业度 2/3|同档停留 ≥8 天|卡点:评估者独立性与披露完备性未验证,失调无训练侧修正方案FG. agent 技能与 harness 标准 — 档位 收敛中|毕业度 1/3|同档停留 ≥8 天|卡点:跨 agent 技能互通标准未立,市场形态刚出现GH. 实时语音智能体 — 档位 收敛中|毕业度 2/3|同档停留 1 天|卡点:Extended Thinking 与实时性的平衡未定,语音链路成本月度级下探,开源侧缺第三方复测HI. 具身智能 — 档位 实验|毕业度 0/3|同档停留 ≥8 天|卡点:零样本泛化宣称无独立复现、无部署规模数据IJ. 模型自改进 / RSI — 档位 实验|毕业度 0/3|同档停留 5 天|卡点:口径未定义、独立核验未落地(26% 是首个公开锚点)J多智能体协作 — 窗口起点:实验09-18 进档2. Anthropic 研发节奏三指标(Claude 主导 26%) · S-candidate — 结构重要性够 S(RSI 首个官方量化锚点+测量方法公开),但独立复核门槛未过——数字只有 Anthropic 自己能算,按纪律保持 S-candidate,24-72h 盯核验名单。与候选①排序在后的原因:确认依赖第三方动作,时间表不在自己手里。21. OpenAI 错配披露框架 + 六份报告 · S-confirmed — 四道确认门槛全过:结构影响(v-security 评估子线从承诺进文本+压 f-gov)、官方一手(框架+六报告原文)、真实可用(框架已运转、报告可读)、独立复核(Willison 技术解读+HN+TechCrunch 采访评估机构)。优先于 Anthropic 指标在于它是已落地的制度文本而非待核验的自报数据。1
矢量·双侧证据矢量·仅实验室矢量·仅开源产品形态(在横轴上)今日 S 级今日 A 级今日 B 级底图矢量记 A/B/C…,今日对象记 1/2/3…
A推理成本与专用模型收敛中 · 毕业 1/3 · 停留 ≥8 天
B长任务可靠性收敛中 · 毕业 2/3 · 停留 ≥8 天
C记忆与上下文收敛中 · 毕业 1/3 · 停留 ≥8 天
D多智能体协作收敛中 · 毕业 1/3 · 停留 1 天
E开放权重/开源旗舰收敛中 · 毕业 2/3 · 停留 ≥8 天
Fagent 安全与信任收敛中 · 毕业 2/3 · 停留 ≥8 天
Gagent 技能与 harness 标准收敛中 · 毕业 1/3 · 停留 ≥8 天
H实时语音智能体收敛中 · 毕业 2/3 · 停留 1 天
I具身智能实验 · 毕业 0/3 · 停留 ≥8 天
J模型自改进 / RSI实验 · 毕业 0/3 · 停留 5 天
1OpenAI 错配披露框架 + 六份报告S-confirmed
2Anthropic 研发节奏三指标(Claude 主导 26%)S-candidate
8 天窗口内档位位移 1 次:多智能体协作 09-18。 星与圆点是今天定级的 2 个对象,落在它推动的矢量 × 形态那一格。

今日重点 · 深度拆解

① OpenAI 错配披露框架 + 六份报告 —— 治理从承诺书变成可翻阅的文件

重点候选 · 待验证

① Anthropic 研发节奏三指标 —— RSI 第一次有了官方数字,但数字还没人核过

纵轴 · 能力与技术演进

横轴 · 渗透率

资本与政策

8 天档位迁移带
2026-09-03 ~ 2026-09-18 · 按 canonical id 对齐,全部取自 report_state
09-0309-0409-0609-0809-1209-1309-1509-18纵轴 · 能力矢量推理成本与专用模型(v-cost)推理成本与专用模型推理成本与专用模型 — 09-03|收敛中推理成本与专用模型 — 09-04|收敛中推理成本与专用模型 — 09-06|收敛中推理成本与专用模型 — 09-08|收敛中推理成本与专用模型 — 09-12|收敛中推理成本与专用模型 — 09-13|收敛中推理成本与专用模型 — 09-15|收敛中推理成本与专用模型 — 09-18|收敛中长任务可靠性(v-longtask)长任务可靠性长任务可靠性 — 09-03|收敛中长任务可靠性 — 09-04|收敛中长任务可靠性 — 09-06|收敛中长任务可靠性 — 09-08|收敛中长任务可靠性 — 09-12|收敛中长任务可靠性 — 09-13|收敛中长任务可靠性 — 09-15|收敛中长任务可靠性 — 09-18|收敛中记忆与上下文(v-memory)记忆与上下文记忆与上下文 — 09-03|收敛中记忆与上下文 — 09-04|收敛中记忆与上下文 — 09-06|收敛中记忆与上下文 — 09-08|收敛中记忆与上下文 — 09-12|收敛中记忆与上下文 — 09-13|收敛中记忆与上下文 — 09-15|收敛中记忆与上下文 — 09-18|收敛中多智能体协作(v-multiagent)多智能体协作多智能体协作 — 09-15|实验多智能体协作 — 09-18|收敛中↑ 进档开放权重/开源旗舰(v-openflagship)开放权重/开源旗舰开放权重/开源旗舰 — 09-03|收敛中开放权重/开源旗舰 — 09-04|收敛中开放权重/开源旗舰 — 09-06|收敛中开放权重/开源旗舰 — 09-08|收敛中开放权重/开源旗舰 — 09-12|收敛中开放权重/开源旗舰 — 09-13|收敛中开放权重/开源旗舰 — 09-15|收敛中开放权重/开源旗舰 — 09-18|收敛中agent 安全与信任(v-security)agent 安全与信任agent 安全与信任 — 09-03|收敛中agent 安全与信任 — 09-04|收敛中agent 安全与信任 — 09-06|收敛中agent 安全与信任 — 09-08|收敛中agent 安全与信任 — 09-12|收敛中agent 安全与信任 — 09-13|收敛中agent 安全与信任 — 09-15|收敛中agent 安全与信任 — 09-18|收敛中agent 技能与 harness 标准(v-skills)agent 技能与 har…agent 技能与 harness 标准 — 09-03|收敛中agent 技能与 harness 标准 — 09-04|收敛中agent 技能与 harness 标准 — 09-06|收敛中agent 技能与 harness 标准 — 09-08|收敛中agent 技能与 harness 标准 — 09-12|收敛中agent 技能与 harness 标准 — 09-13|收敛中agent 技能与 harness 标准 — 09-15|收敛中agent 技能与 harness 标准 — 09-18|收敛中实时语音智能体(v-voice)实时语音智能体实时语音智能体 — 09-18|收敛中具身智能(v-embodied)具身智能具身智能 — 09-03|实验具身智能 — 09-04|实验具身智能 — 09-06|实验具身智能 — 09-08|实验具身智能 — 09-12|实验具身智能 — 09-13|实验具身智能 — 09-15|实验具身智能 — 09-18|实验模型自改进 / RSI(v-rsi)模型自改进 / RSI模型自改进 / RSI — 09-08|实验模型自改进 / RSI — 09-12|实验模型自改进 / RSI — 09-13|实验模型自改进 / RSI — 09-15|实验模型自改进 / RSI — 09-18|实验横轴 · 产品形态中国 AI 全栈(f-chinastack)中国 AI 全栈中国 AI 全栈 — 09-03|早期采用中国 AI 全栈 — 09-04|早期采用中国 AI 全栈 — 09-06|早期采用中国 AI 全栈 — 09-08|早期采用中国 AI 全栈 — 09-12|早期采用中国 AI 全栈 — 09-13|早期采用中国 AI 全栈 — 09-15|早期采用中国 AI 全栈 — 09-18|早期采用消费级 agent 代办(f-consumer)消费级 agent 代办消费级 agent 代办 — 09-03|萌芽消费级 agent 代办 — 09-04|萌芽消费级 agent 代办 — 09-06|萌芽消费级 agent 代办 — 09-08|萌芽消费级 agent 代办 — 09-12|早期采用↑ 进档消费级 agent 代办 — 09-13|早期采用消费级 agent 代办 — 09-15|早期采用消费级 agent 代办 — 09-18|早期采用开发者 agent 入口(f-devagent)开发者 agent 入口开发者 agent 入口 — 09-03|早期采用开发者 agent 入口 — 09-04|早期采用开发者 agent 入口 — 09-06|早期采用开发者 agent 入口 — 09-08|早期采用开发者 agent 入口 — 09-12|早期采用开发者 agent 入口 — 09-13|早期采用开发者 agent 入口 — 09-15|早期采用开发者 agent 入口 — 09-18|早期采用企业知识工作(f-knowledgework)企业知识工作企业知识工作 — 09-03|早期采用企业知识工作 — 09-04|早期采用企业知识工作 — 09-06|早期采用企业知识工作 — 09-08|早期采用企业知识工作 — 09-12|早期采用企业知识工作 — 09-13|早期采用企业知识工作 — 09-15|早期采用企业知识工作 — 09-18|早期采用端侧/可穿戴 AI 入口(f-caros)端侧/可穿戴 AI 入口端侧/可穿戴 AI 入口 — 09-03|萌芽端侧/可穿戴 AI 入口 — 09-04|萌芽端侧/可穿戴 AI 入口 — 09-06|萌芽端侧/可穿戴 AI 入口 — 09-08|萌芽端侧/可穿戴 AI 入口 — 09-12|萌芽端侧/可穿戴 AI 入口 — 09-13|萌芽端侧/可穿戴 AI 入口 — 09-15|萌芽端侧/可穿戴 AI 入口 — 09-18|萌芽政府/公共入口(f-gov)政府/公共入口政府/公共入口 — 09-03|萌芽政府/公共入口 — 09-04|萌芽政府/公共入口 — 09-06|萌芽政府/公共入口 — 09-08|萌芽政府/公共入口 — 09-12|萌芽政府/公共入口 — 09-13|萌芽政府/公共入口 — 09-15|萌芽政府/公共入口 — 09-18|萌芽AI 音乐生成(f-musicgen)AI 音乐生成AI 音乐生成 — 09-13|萌芽AI 音乐生成 — 09-15|萌芽AI 音乐生成 — 09-18|萌芽8 天内档位变化合计:2 次
实验 / 萌芽收敛中 / 早期采用事实标准 / 主流化无声消失
每格一天,颜色是当天的档位。8 天里合计 2 次档位变化。

待跟踪

未来 24-72h 待跟踪:

待印证的能力矢量(纵轴)待观察的渗透(横轴)待发布动作 / 待验证项目
安全与信任:9/20 评估者章程/标准机构文本窗口收口(T-170);错配框架运转首周报告(T-172);霍奇猜想官方公告(T-166)企业知识工作:Astra for Law API 上线与律所扩散;Databricks 式"全员部署"是否复制9/20 Anthropic 节奏指标第三方核验机构名单(T-173);9/21 Googlebook 预购
实时语音(新矢量):开源侧对 3.8 Live 的复测;Codex 语音智能体实际表现消费代办:Muse Mac 使用数据(T-167);Google CC waitlist 转化9/29 OpenAI DevDay 下一代模型披露(T-168);Helix 2.5 独立复现(T-174)
成本与专用模型:Jev 第三方测评是否出现;Pareto 26.10 公开发布端侧入口:豆包手机首批使用/留存数据(f-caros 跨档判定)9/30 Anthropic IPO 招股书窗口与台账集中复查
上一期 open 项已逐条结算并回写 watchboard:T-165(misalignment 披露框架)确认兑现,T-150(记忆统一)确认兑现,其余顺延或并入母题;结算细节在台账不在正文。