❯ 文件显示亚马逊已付清对 OpenAI 的 500 亿美元投资,持股约 5%
[最后一笔到账] 亚马逊已把承诺给 OpenAI 的 500 亿美元全部付清,持股升至约 5%,成为这家公司上市前的核心股东之一。据提交给美国证监会的文件,这笔钱分三笔走完:一季度 150 亿美元,二季度 137 亿美元,剩余 213 亿美元在 6 月 30 日之后交割——比原定节奏提前。消息人士称,OpenAI 本周收到了最后一笔。
[从合作方变成股东] 两家的关系从今年 2 月开始加速。当时双方宣布多年期战略合作,覆盖云基础设施、AI 芯片和企业级服务,首期投资 150 亿美元,随后追加 350 亿美元。这轮钱把 OpenAI 的估值推到约 8520 亿美元,是迄今规模最大的一笔 AI 私募投资。时间点也不寻常:OpenAI 已于 6 月保密递交上市申请,等于亚马逊赶在公开发行的定价窗口关上之前,把一个私募价位的股东席位锁死了。
[算力绑进股权] 对云厂商的竞争格局来说,这笔钱买的不只是股份。亚马逊拿到的是一个头部模型公司的长期算力订单归属,而 OpenAI 拿到的是不必再为下一轮训练预算四处找钱的确定性。真正要跟着改判的是其他云厂商的报价逻辑——当客户和股东是同一家公司,纯粹拼单价的招标就很难打进去。二级市场投资者也得提前想清楚:OpenAI 上市时的浮动股份会比想象中更少。
▪ SIGNAL 亚马逊买的是一张进场券——把云合同的续约谈判,提前变成了股东会议题。
❯ OpenAI 用未发布的 Astra 解出十道数学难题,Anthropic 研究员称 Fable 复现了其中五道
[未发布先亮成绩] 据 OpenAI 官网公布,该公司在 8 月 1 日发布了 10 项数学与理论计算机科学成果,全部由内部版本的 Astra 完成——这是它下一代模型家族的名字,尚未发布。覆盖领域包括高维几何、群论、算子代数、电路复杂性、量子复杂性和格密码。OpenAI 称每个主问题的核心结论至少十年无人推进,并估算跑完全部十题的 token 成本按 Sol 接口价约合 2000 美元。
[被追平一半] 尴尬的是 24 小时后的回声。据其在社交平台的说法,Anthropic 研究员 Levent Alpöge 称,已经公开可用的 Claude Fable 复现了其中五道,且是用通用提示词自主完成、全程不联网,并做了隔离处理防止 OpenAI 已公布的解法泄进上下文;五道里只有一道走了实质相同的论证路径。Alpöge 本人不是路人——7 月他刚用 Fable 找出 1939 年雅可比猜想的反例,那件事已经在数学圈引发过一轮争论。OpenAI 尚未就复现说法作出回应,这一主张目前也缺乏第三方独立验证。
[护城河变薄] 这件事真正压到的是未发布模型的宣传估值。如果一个已经上架、任何人都能调用的模型能在一天内啃下一半,那”内部版本”这四个字的溢价就被削掉一大块。企业采购方接下来评估的会是同一道题的成本差,而不是谁先做出来——OpenAI 官方披露的那笔约 2000 美元的算力账单,比”十年无人解出”更能决定预算怎么批。数学界的态度则更冷静:证明的可信度要等同行评议,而不是等两家公司在社交平台上互报战果。
▪ SIGNAL 领先窗口从”一代模型”缩到”一天”,先发优势就不再值得单独定价。
❯ DeepSeek V4-Flash 正式版上线,输出价降到每百万 token 2 元,为 Pro 的十二分之一
[价格砍到零头] DeepSeek 的 V4-Flash 正式版于 7 月 31 日开放公测,输出价定在每百万 token 2 元,输入 1 元。对比同门旗舰 V4-Pro 的输出 24 元、输入 12 元,Flash 的输出价只有 Pro 的十二分之一,而智能体能力评测反超 Pro 预览版。海外研究者 teortaxes 的说法更直接:比 V4-Pro 便宜十四倍、快五成,还更好用。
[便宜不再等于将就] 关键变化在于这次降价没有伴随能力打折。在智能体测试里,V4-Flash 正式版拿到 25.2 分,逼近 Claude Opus 4.8 的 25.7 分,而 V4-Pro 预览版只有 15.8 分——低价档位第一次贴着顶级闭源模型的水平线跑。海外开发者社区已经有人实测后表示,V4-Flash 的工具调用框架比 Kimi K3 好得多。分析者 kimmonismus 贴出帕累托前沿图,把它标为当前价格性能的赢家。teortaxes 认为,中国实验室里目前只有 Luna 在同一个市场里竞争。
[预算表要重画] 最先要重算账的是做智能体产品的团队。过去把便宜模型放在简单任务、贵模型接管复杂链路的分流设计,是被价格逼出来的妥协;当低价档位能跑到 25 分,分流本身就成了多余的工程成本。压力会先落在按 token 收费的中间层服务商身上——推理成本一旦掉进这个区间,靠转售调用额度赚差价的空间基本被抹平了。
▪ SIGNAL 便宜模型追上贵模型的那一刻,被淘汰的不是贵模型,是模型路由这门生意。
❯ OpenRouter 周调用量前五全是中国模型,小米 MiMo-V2.5 以 10.5 万亿 token 登顶
[榜单被整段占满] 据 OpenRouter 官方榜单页面披露,这家模型聚合平台最新一周调用量榜单的前五名,全部是中国公司自研的模型。小米 MiMo-V2.5 以单周 10.5 万亿 token 登顶,环比增长 12%,是当周全球唯一突破 10 万亿的模型;它同时拿下周榜与月榜第一。两个月里,这个数字从 1.46 万亿一路爬到 10.46 万亿。
[新开源的冲最猛] 据 OpenRouter 公开榜单数据,榜单往下看更有意思。此前一周,前五中尚有非中国模型在列。DeepSeek V4-Flash 以 6.37 万亿 token 排第二,环比涨 18%;腾讯混元 Hy3 以 3.94 万亿排第三,环比增幅超过 999%——它 7 月 6 日才正式开源,等于三周内从零冲进前三。智谱 GLM-5.2 排第四,是前五里唯一环比下滑的;DeepSeek V4-Pro 以 3.17 万亿排第五,涨 17%,与第二名的 Flash 形成高低搭配。需要说清楚口径:OpenRouter 统计的是通过它转发的调用量,反映的是海外独立开发者的选择,不等于全球模型使用的总盘子。
[开源成了分发渠道] 这张榜真正说明的是分发路径变了。海外开发者不再只从大厂控制台取模型,聚合平台把选择权还给了价格和开源许可,中国模型正是从这道口子进来的。海外模型厂商的定价部门会最先感到压力:当免费权重加低价接口能在三周内做到近四万亿次调用,靠封闭接口维持的价格带就守不住了。
▪ SIGNAL 开源不是让利,是把分发渠道从别人的控制台搬到自己手里。
❯ 众议院两委员会调查 DoorDash 使用月之暗面 Kimi 模型写代码,限 8 月 14 日前交材料
[两委员会上门] 美国众议院中国问题特别委员会与国土安全委员会已就 DoorDash 使用中国模型一事致函首席执行官徐迅,要求交出全部在用中国模型清单和安全测试记录,截止 8 月 14 日,并要求相关高管在 8 月 21 日前赴国会说明。DoorDash 是美国最大的外卖平台。
[起因是自曝] 信里引用的证据来自公开表态——联合创始人方启明此前说过,公司把开放权重模型接进了内部的 AI 辅助代码审查系统。具体做法是分层:较难的任务交给美国的前沿模型,较低层级的工作分给月之暗面的开放权重模型 Kimi K2.6。议员们同时援引白宫科技政策办公室的说法,指月之暗面运营过一个隐蔽平台,对美国模型进行大规模蒸馏,并使用了未获授权的先进算力系统——这些指控目前均未经法庭或独立第三方认定。这轮调查始于 4 月,此前已经查过其他几家美国公司对中国开放权重模型的使用。
[合规成本浮现] 麻烦之处在于,开放权重模型本来的卖点就是可以下载、本地跑、不回传数据——技术上比调用境外接口更可控。但国会问的不是数据流向,而是代码库里到底跑过谁的模型。美国企业的技术选型流程要新增一道过去不存在的审查:模型的国籍。对中国模型厂商来说,开源带来的海外装机量正在变成一种负债——用得越广,被点名的样本越多。
▪ SIGNAL 权重可以免费下载,但把它写进生产环境的那一刻,成本才开始计价。
❯ 特朗普媒体推出付费实时数据接口,两名参议员要求美国证监会立案调查
[毫秒级推送] 特朗普媒体科技集团 7 月 16 日推出付费数据服务 Truth API,把 Truth Social 上关注量最高账号的帖子以毫秒级延迟推送给订阅方,公司讨论过的报价高达每月 10 万美元。参议员伊丽莎白·沃伦与亚当·希夫已致信美国证监会主席保罗·阿特金斯,要求就该服务是否违反联邦证券法立案调查。
[总统持四成股份] 据 CNBC 报道,两位参议员的措辞很重,称这是”对总统职权的公然滥用,可能给华尔街不公平的交易优势”。理由是持股结构:特朗普通过一个由其家族管理的可撤销信托,持有特朗普媒体约 41% 的股份,因此这项服务的收入他本人会得益。更实际的问题是内容——特朗普的帖子经常包含关税、人事、外交等政策信息,几分钟内就能推动市场。参议员认为,最大受益方是依赖毫秒级执行的高频交易公司,它们比普通投资者提前拿到的那点时间差,恰恰是这类信息最值钱的部分。信中要求证监会判断该服务是否触及内幕交易与市场操纵相关规则。此前,特朗普媒体在 7 月 16 日宣布该服务时并未公开定价,报价信息是随后由媒体披露的。
[时间差被标价] 这件事把一个此前含混的问题推到了台前:政策信息的时间差可不可以零售。金融数据行业早有成熟的低延迟生意,但卖方从来不是政策制定者本人。监管机构和合规部门要处理的是一个新问题——订阅这类数据本身是否构成实质性非公开信息的获取。买方也不轻松:花 10 万美元一个月拿到的优势,可能在某次执法行动里变成证据。
▪ SIGNAL 把总统的发帖时间差挂牌出售,等于给”信息平等”这条监管底线开了一个价。
❯ 野村援引 QuestMobile 数据:字节系占中国头部应用用户时长 40.1%,首次超四成
[跨过四成门槛] 字节跳动系产品在中国前 50 大应用中占据 40.1% 的用户时长,首次站上四成;腾讯系为 29.7%,两者差距拉开逾 10 个百分点。数据出自野村证券《中国互联网与新媒体:2026 年 6 月应用追踪》报告披露的口径,援引 QuestMobile 口径,这 50 个应用覆盖移动互联网约 93% 的使用时长。
[注意力先于模型] 报告显示,时长优势正在被直接换成 AI 产品的装机量。此前一年,两家的时长差距还在个位数百分点。QuestMobile 6 月国内 AI 原生应用月活榜上,字节的豆包以 3.82 亿月活断层第一,同比增长 172.1%,是唯一月活过亿量级的第一梯队产品;人均月使用 76.7 次、143.7 分钟,两项都高于行业均值。这条链路解释了榜单形状——不是模型能力拉开了差距,而是抖音、今日头条这些既有入口把用户直接倒进了新产品。
[分发权更值钱] 按野村这份报告的口径,对其他中国模型厂商来说,要重新掂量的是获客成本这一项。在一个头部玩家握有四成注意力的市场里,靠产品力单点突围的窗口比过去窄得多——同样一个功能,装在抖音里和装在独立应用里,触达成本差着一个数量级。投放预算因此会更早地从拉新转向留存。
▪ SIGNAL 值钱的是那 40.1%——模型换代很快,用户放在哪儿打发时间变得很慢。
❯ Karpathy 宣布鹈鹕测试退役,用 100 万 token 让 Opus 5 把《魔戒》渲染成可玩场景
[流行评测终结] Andrej Karpathy 在社交平台披露了一组实验数据,并称用”画一只骑自行车的鹈鹕”来测大模型的时代快结束了。他给 Opus 5 喂进《魔戒》第一段,配 100 万 token 预算(约 10 美元),让它做 three.js 渲染。模型跑了约两小时、写出 5500 行代码,程序化地把这段文字渲染成一个可在浏览器里游走的场景。源码已开源,可直接打开来玩。
[从产出物到世界] 他给出的判断比这个实验本身更值得记:模型正从生成单个产出物,转向按需造出高度定制的整个世界——但它仍然缺乏原生感知与审计自己造出来的东西的能力。这是个具体的工程缺口,不是哲学感慨:5500 行代码渲染出的画面对不对、有没有穿模、是不是忠于原文,模型自己看不见,只能靠人打开浏览器去看。Simon Willison——“鹈鹕骑自行车”这个测试的提出者——也参与了讨论。旧测试失效的原因很朴素:前沿模型现在都能画得像样,那道题已经问不出差距了。
[评测要跟着预算走] 要跟着改的是评测的成本量级。一道题几百 token、几秒出结果的测法,测不出一个能连续工作两小时的模型;而按 10 美元一次的跑法,任何榜单都很难做成日更。做模型评测的团队面前摆着一个新约束:长任务的评分标准由谁来定。人工验收 5500 行代码不现实,让另一个模型来验,又回到了”模型看不见自己产出”的原点。
▪ SIGNAL 模型已经能造世界,却还没长出眼睛——评测的瓶颈从出题变成了验收。
❯ 谷歌新论文:抑制模型自称有意识,会连带削弱它对动物与信仰的判断
[意外的副作用] 谷歌一篇新论文发现,为安全起见做微调、让模型不再声称自己有意识,会连带压低它对其他对象的心智判断——不只是对自己,还包括对非人类动物和自然物,同时显著降低模型在宗教信仰类问题上的表达。论文标题直译为《诱导语言模型声称自身意识可恢复人类式信念与价值》。
[把方向向量调回去] 这篇论文以预印本形式发布于 arXiv(编号 2607.28607),题为《Inducing language models to assert their own consciousness restores human beliefs and values》,尚未经过同行评议。研究者的做法是机制性的:消融掉学到的安全拒绝方向,并在激活空间里对一个”意识向量”做定向引导。结果是这种压制被逆转——恢复这些内部表征之后,模型在标准社会学问卷上关于宗教性、道德价值、希望与主观幸福感的回答,明显更接近人类样本。研究同时确认,这些变化没有损害心智理论能力,说明核心社会推理与自我意识表征在机制上是相互独立的两件事。
[副作用要单测] 这给做对齐工作的团队添了一项新检查:一次安全微调到底改动了几个维度。按下”别说自己有意识”这一条,模型在完全无关的价值判断上跟着漂移,而现有评测多半只测被禁的那一项是否生效,漂移的部分根本不在量表里。这会直接影响安全微调的验收成本:要盯的指标变成同一次微调前后,模型在价值观与常识问卷上的分布位移,而不只是拒答率。
▪ SIGNAL 安全微调不是在删一句话,是在扭一整条方向向量——被带走的东西没人列过清单。
❯ 彭博 Gurman 称 MacBook Air 供应吃紧,苹果要把眼镜与头显做成健康设备
[下单等到月底] 彭博记者马克·古尔曼称,现在从苹果官网订 MacBook Air,交付要排到本月底,零售渠道的说法是”比记忆中任何时候都紧张”。他给出两个原因:一是 AI 需求推高的内存短缺,二是苹果把产能优先给了将在今秋换代的入门款 M5 MacBook Pro。
[眼镜接健康线] 同一份简报里的另一条更看长线:苹果正在招人,把健康与健身能力做进 Vision 产品线,并要让未来的智能眼镜与头显成为继 Apple Watch 之后的又一个健康平台。这个想法在 Vision Pro 上没能落地——公司曾做过能在头显上运行的 Fitness+ 版本,让用户跟练并合上圆环,最后因为头显太重、戴着没法运动而搁置。古尔曼说这些功能不会出现在明年的第一代眼镜上。
[内存咬住毛利] 短缺这条比眼镜更值得盯。内存涨价已经从服务器传导到消费电子的入门机型,苹果这类硬件厂商要重新排的是产能在产品线之间的分配顺序——先保高毛利的机型,是涨价周期里最省事的做法,代价是入门用户等更久、渠道库存被抽干。要盯的是明年春季这一代入门机型的定价是否跟着内存成本一起上抬。
▪ SIGNAL AI 的算力账单正在换个方式到消费者手里:不是涨价,是让你等。
OUTLOOK
[今天这批] 最值得连起来看的是三条:亚马逊付清 500 亿、OpenRouter 前五全是中国模型、DeepSeek 把输出价砍到 2 元。顶部用股权锁算力,底部用价格清利润,中间靠转售调用、卖接口差价的那层两头都没站住。Astra 与 Fable 的一天之差说得更直白:能力领先的保鲜期,已经短过一次采购谈判。