❯ Meta 和微软压缩员工使用 Claude,Meta 内部 Claude Code 用户从约 6 万降到约 3 万
两家大客户在减量据 The Information 独家报道,Meta 和微软正在减少员工对 Anthropic 旗下 Claude 的使用,把他们引向自家的 AI 工具。Meta 内部使用 Claude Code 的员工已从今年早些时候的约 6 万人降到约 3 万人;微软则把原本预计超过 10 亿美元的内部 Anthropic 年度支出砍掉了三分之一以上。
替代品是自己的工具据 AI Weekly 转述,Meta 自研的编程工具 MetaCode 用户已超过 3 万,Muse Code 有 6000 多名内部用户;报道称 Meta 的自研工具和 Muse Spark 系列模型已基本取代了对 Claude 的需求。微软方面,高层要求员工少用 Claude,“体验与设备”部门的工程师已迁往 GitHub Copilot CLI。
降幅里有裁员的因素Meta 用户数减半并不全是主动替换:它今年春季裁掉了约 10% 的员工,这解释了一部分下降。报道还提到,Meta 此前预计每年在 Anthropic 上的支出最高可达 100 亿美元。微软对 Anthropic 的 50 亿美元投资没有变化,Anthropic 通过 Azure 和 Bedrock 获得的企业订单仍在增长。
对上市前的 Anthropic 意味着什么Anthropic 的招股书草稿显示,近四分之一的收入来自两家未具名客户,许多大客户没有长期合同。大科技公司既是它的客户,又是它的竞争对手,一旦自研工具够用,就有动力把钱留在内部。企业订单能否补上这类内部用量的缺口,要看它下一次披露的收入数字。
▮ SIGNAL模型公司最大的客户往往也是最有能力自己做模型的公司,这类收入来得快,走的时候也不需要理由。
❯ SemiAnalysis 实测:同价订阅下 Claude Opus 5.5 的可用量约为 GPT-6.1 Sol 的五倍
20 美元能买到多少研究机构 SemiAnalysis 实测了九家公司的 AI 订阅套餐,结论是:在同样的价格下,Anthropic 订阅给到的用量,按 API 标价折算约为 OpenAI 的 5 倍。20 美元的 Claude Pro 用 Opus 5.5 约可折合 1200 美元的 API 用量,20 美元的 ChatGPT Plus 用 GPT-6.1 Sol 约为 280 美元;200 美元一档分别约为 1.2 万美元和 1400 美元。
怎么测的订阅套餐不公布具体额度,只显示一个用量进度条。据 Implicator 介绍,SemiAnalysis 把《战争与和平》的片段和技术文章喂给付费账号,记录进度条每走一格消耗了多少 Token,再按各家公开的 API 单价和它自己统计的 9 月代理类工作负载比例换算成美元,误差控制在正负 5% 以内。
OpenAI 刚把额度减半差距拉大与近期调整有关。OpenAI 把 200 美元套餐的各档模型额度减半,老用户的旧额度保留到 10 月 29 日;新推出的 500 美元套餐,Astra 用量只比原来的 200 美元套餐多 21%。Anthropic 则在 Opus 5.5 降价的同时上调了 Opus 额度。两家旗舰模型 Fable 5.1 和 GPT-6 Astra 的额度相近,5 倍差距出现在中档模型上。
用量给得多,利润就薄报告提醒,这个数字衡量的是按标价折算的额度,不代表用户真能多完成五倍的工作。它还估算,如果用户把 Opus 5.5 的额度全部用完,Anthropic 的毛利率为负 369%;按平均用掉 20% 计算才转正到 6%。订阅约占 Anthropic 收入的一成,却消耗了四成以上的推理算力。
▮ SIGNAL订阅价格都是 20 美元和 200 美元,真正的价格战打在看不见的额度上,谁给得多,谁就在用毛利换用户。
❯ Codex“28 天承诺”首日兑现:订阅用户的 GPT-6 Astra 和 GPT-6.1 Sol 输出速度从每秒 30 个 Token 提到 50 个
第一天交的是速度OpenAI 负责 Codex 的 Thibault Sottiaux 10 月 5 日在 X 上发帖:“第 1 天”,订阅用户使用 GPT-6 Astra 和 GPT-6.1 Sol 的默认速度提升约 50%,覆盖 OpenAI 自家产品以及通过“用 ChatGPT 登录”接入的合作方,包括 OpenCode、Pi、Amp 和 Devin。他随后补充,速度从每秒 30 个 Token 提到 50 个。帖子浏览量超过 160 万。
前一天许下的诺这是他前一天承诺的第一次兑现:未来 28 天里,团队每天要么上线一项对多数 Codex 和 Work 用户有明显改进的更新,要么给用户做一次额度重置。这次提速不需要用户做任何改动,按他的说法两小时内生效。
没有第三方数据据 Runtime Wire 指出,从 30 到 50 实际是约 67% 的提升;OpenAI 没有提供独立测量结果,这个数字衡量的只是文字输出的流速,不等于整个任务完成得更快,也不改变用户触及用量上限前能做多少事。
用户的反应并不一致Ethan Mollick 在 X 上评论说,“重置”这套做法很奇怪,只有很小一部分人看得懂,多数用户希望能理性地规划用量,而不是随机拿到一批 Token。提速对所有订阅用户都有感知,比重置额度更容易被普通用户理解。
▮ SIGNAL在额度被质疑的时候先交付速度,是用一个人人都能感觉到的指标,去回应一个只有重度用户才会计算的问题。
❯ Reflection 发布首个开放权重模型 Beam,称推理算力只需 GLM-5.2 的三到四分之一
5010 亿参数,只激活 230 亿英伟达投资的 Reflection AI 10 月 5 日发布首个开放权重模型 Beam。据 MarkTechPost 介绍,它采用稀疏的混合专家架构,总参数 5010 亿,每次只激活其中 230 亿,面向编程、推理和代理任务,上下文可达 100 万 Token。完整权重计划 10 月下旬以 Apache 2.0 许可放出,目前早期版本通过候补名单开放。
四周训完混合专家架构的意思是,模型内部有许多“专家”模块,每次回答只调用一小部分,所以总参数很大而实际计算量小。Reflection 称,Beam 用 6144 块英伟达 GB300 GPU 在不到四周内完成预训练,数据量 23.8 万亿 Token;强化学习阶段跑了 1 亿多次任务,用到约 13 亿个沙箱环境。
自称接近中国头部开放模型Reflection 说,Beam 在多数任务上可与 GLM-5.2 相比,在编程和代理任务上接近 Qwen 3.8-Max,同时承认 Kimi K3 的原始能力更强。所谓推理算力少三到四倍,公司自己说明是“近似的算力对比,而非实测的推理成本”,没有计入提示词预处理和服务开销。评测机构 Artificial Analysis 表示已拿到权限,正在独立测试。
美国开放模型的位置研究者 Nathan Lambert 在 X 上评论说,Reflection 和英伟达、Thinking Machines 一样,拿出了自己最强的模型,结果仍排在中国同行之后,最清楚的结论是中国团队非常擅长做大模型。想在自己的服务器上部署模型的企业,多了一个来自美国公司的选择,但它是否真的省算力,要等权重放出后由第三方验证。
▮ SIGNAL美国公司做开放模型,已经不再宣称超过中国同行,而是改讲“同等能力下更省算力”,竞争的参照系悄悄换了。
❯ OpenAI 洽谈 300 亿美元新融资,阿联酋多只基金拟合计出资最高 100 亿美元
300 亿美元,估值 1.4 万亿据彭博报道、The Next Web 转述,OpenAI 正与阿联酋多只投资基金洽谈,由它们作为锚定投资者参与一轮 300 亿美元的融资,其中包括阿布扎比的 MGX。这些基金讨论的合计出资最高为 100 亿美元。本轮投前估值约 1.4 万亿美元。
价格由 OpenAI 自己定这轮融资的做法不同寻常:通常由投资者报出条款、领投方与公司谈定估值,这次 OpenAI 直接给出固定价格,也没有选定领投方。贝莱德正在洽谈参与,加州大学捐赠基金以及现有股东 Thrive Capital、Andreessen Horowitz 也在讨论之列。谈判尚未敲定,细节可能变化;OpenAI 和贝莱德拒绝置评,MGX 未回应。
七个月估值涨了六成多OpenAI 上一轮融资在今年 3 月,募资 1220 亿美元,投后估值 8520 亿美元。MGX 今年已募集约 500 亿美元,同时持有 OpenAI、Anthropic 和 xAI 的股份,还与贝莱德、微软、英伟达共同运营一只 300 亿美元的基础设施基金。
中东资金的分量一次要融 300 亿美元,能接得住的买家本来就不多。MGX 同时投资几家互相竞争的实验室,押的是整个行业而不是某一家;对 OpenAI 来说,自己定价、不设领投,说明它判断买方的需求足够强。
▮ SIGNAL当一家公司可以不设领投、直接报价融 300 亿美元,资本市场里稀缺的已经不是钱,而是能装下这么多钱的标的。
❯ OpenAI 本月起在 ChatGPT 生成图片时测试视觉广告,先面向美国的免费用户
等图的时候看广告OpenAI 10 月 5 日宣布一种新的视觉广告形式:用户在 ChatGPT 里生成图片时,页面上会出现带图片的广告。据 BleepingComputer 报道,测试将在 10 月晚些时候从美国开始,首批只有少数广告主,面向没有付费订阅的用户。
标注清楚,不影响回答OpenAI 表示,广告会明确标注,与用户生成的图片分开,也不会影响 ChatGPT 的回答。广告可以用图片展示产品灵感、使用方式或服务体验。公司还说,设有防护措施,避免广告出现在情绪脆弱、敏感或其他不合适的对话里。
配套的广告基础设施这次同时接入了一批第三方广告技术公司:Hightouch、Tealium、LiveRamp 负责转化追踪,AppsFlyer、Adjust、Branch 等负责归因,DoubleVerify 和 Integral Ad Science 负责品牌安全。ChatGPT 每周有 12 亿用户,这是广告主愿意进来的原因。
免费用户怎么变成收入这批广告面向的是不付费的用户,而每次生成图片都要消耗算力。把广告放在等待出图的间隙,对体验的打扰相对小。它能做多大,取决于用户是否接受,以及 OpenAI 能否让人相信广告确实没有影响回答。
▮ SIGNAL聊天机器人最终走上了和搜索引擎一样的路,先用免费聚拢用户,再把注意力卖给广告主。
❯ 推理芯片公司 Etched 收到 400 亿至 500 亿美元估值的投资报价,两个月前为 210 亿美元
报价翻倍据 TechCrunch 援引知情人士报道、AI Weekly 转述,AI 推理芯片公司 Etched 正在收到新的投资报价,估值在 400 亿至 500 亿美元之间。谈判处于早期,尚未完成任何融资,条款可能变化。
专做推理的芯片Etched 2022 年成立,三位创始人 Gavin Uberti、Chris Zhu 和 Robert Wachen 都是哈佛辍学生。它只做“推理”用的芯片,也就是模型训练好之后回答用户请求的那一步,并称自家芯片处理 Token 比英伟达更快、更便宜。据 Trending Topics 介绍,它把推理拆成读入提示词和逐字生成两个阶段,各自设计了专用硬件。
年初估值还是 50 亿美元Etched 今年初估值约 50 亿美元;7 月完成红杉领投的 3 亿美元 C 轮,估值 103 亿美元;上一轮由 Jane Street 领投 7 亿美元,估值 210 亿美元。Jane Street 也是它的早期客户,已在自己的数据中心运行 Etched 的机柜。公司 7 月称已拿到 10 亿美元客户订单,现有约 400 名员工。
估值跑在交付前面AI Weekly 提醒,这次估值上调反映的是 Etched 的路线图而不是收入,客户是谁、何时交付都还不清楚,如果交付拖到 2027 年,估值会受明显影响。投资人给出的价格,押的是它能按时把这些芯片交到客户手里。
▮ SIGNAL推理芯片的估值两个月翻一倍,买的是“英伟达之外还有别的选择”这个可能性,而它目前还没有被大规模交付验证过。
❯ 两名前 Groq 工程师起诉董事会,称与英伟达的 200 亿美元授权交易亏待普通股东
告的是交易结构两名持有 Groq 股份的前工程师 Benjamin Serebrin 和 Joshua Rubin 上周五在特拉华州提起诉讼,被告是英伟达和 Groq 董事会。据 National Technology 报道,诉状称董事会不当出售了核心资产,为自己、高管和关联基金拿走了数十亿美元的利益,却没有与其他股东分享。
名为授权,人走了九成Groq 是一家 AI 芯片公司。2025 年 12 月,英伟达宣布与它达成约 200 亿美元的“非排他”技术授权,Groq 名义上保持独立。据 Crypto Briefing 梳理,其中 170 亿美元是现金授权费,另有 30 亿美元英伟达股票,专门奖励给加入英伟达的约 200 名工程师。包括创始人 Jonathan Ross 在内,Groq 约九成员工转到了英伟达。
普通股东拿得少原告称,普通股是折价卖出的,而离职加入英伟达的工程师另有补偿。这起诉讼针对的正是这种结构:不做传统收购,而是付授权费、另给加入的团队发股票,钱在不同类别的股东之间分得并不均匀。今年 9 月,美国司法部已对这笔交易展开反垄断调查,审查它是否绕开了并购申报要求。
各方表态Groq 称指控“毫无根据”,并表示这笔授权带来了“非凡的价值”;英伟达拒绝置评。如果法院认定董事会失职,其他采用类似结构的交易也会面临股东追索,大公司今后用“授权加挖人”代替收购的成本会上升。
▮ SIGNAL“不算收购的收购”绕开了反垄断审查,也绕开了普通股东的投票权,现在两头都开始找上门来。
❯ 华为与高通签署多年期专利交叉许可,高通获得华为 LogicFolding 芯片技术授权
互相授权,高通还买专利华为与高通 10 月 5 日宣布签署多年期专利许可协议,覆盖 5G、AI、计算和网络技术。据 The Next Web 报道,双方互相获得对方专利的使用权,高通还将购买华为在计算、AI、网络等领域的部分美国专利,这部分需监管机构批准。金额和费率没有披露。
LogicFolding 被对手认可据彭博报道,高通获得授权的技术中包括华为新近公布的 LogicFolding 芯片架构,以及用于高速互连的光学封装技术。由于拿不到 ASML 的极紫外光刻机,华为没有走继续缩小晶体管的路线,而是通过改进芯片内部的数据传输来提升性能,LogicFolding 是这一思路的成果。
从付费方到收费方华为 2001 年第一次向高通支付专利费,2011 年才从摩托罗拉拿到第一笔专利收入,其专利许可业务自 2021 年起收入为正。华为称,这笔交易完成后,它的专利许可协议总价值将超过 69 亿美元。美国 2019 年以来的贸易限制约束的是华为获取先进芯片和软件,并不自动禁止专利许可。
制裁之外的另一条通道高通愿意为华为的芯片技术取得授权,等于承认这些技术有价值。出口管制能阻止设备和芯片流入中国,却管不到知识产权反向流出。这笔交易是否顺利过审,会显示美国监管对这类合作的态度。
▮ SIGNAL被禁止购买先进设备的公司,开始向美国芯片公司出售技术授权,管制改变了货物的流向,却没能阻止技术产生价值。
❯ SpaceX 股价单日上涨 7.6% 创 6 月中旬以来新高,马斯克身家重回万亿美元
大涨 7.6%SpaceX 股价 10 月 5 日收涨 7.6%,达到 6 月中旬以来的最高水平。据 Techmeme 转述 CNBC 的报道,上涨的直接原因是摩根士丹利称这只股票“便宜”,这也让马斯克重新成为身家超过万亿美元的富豪。
上市后的过山车SpaceX 今年 6 月 12 日在纳斯达克上市,发行价 135 美元,募资 860 亿美元,是史上最大的 IPO。首日收于 161 美元,市值约 2.1 万亿美元,马斯克一度成为全球首位万亿富豪;到 7 月下旬,股价已从高点下跌约 50%。他在上市后持有约 42% 的股份。
AI 成了估值理由摩根士丹利分析师 Adam Jonas 给出的目标价是 300 美元。SpaceX 今年 2 月收购了 xAI,旗下 AI 部门目前对外出租算力,客户包括 Anthropic。投资者现在给它估值时,除了火箭和星链,还要算上这块 AI 业务。
一家公司,三种生意SpaceX 流通在外的股份很少,上市时公开发行的只占约 5%,这会放大股价的波动。它同时是航天公司、卫星运营商和算力出租方,分析师用哪一套估值方法,结论相差很大,这也是股价大起大落的原因之一。
▮ SIGNAL一家火箭公司的股价要靠 AI 业务来解释,说明资本市场眼下愿意为任何能接上 AI 需求的资产重新定价。
❯ 豆包团队传出中秋加班六天赶制个人助理 Spell,对标 Meta 的 Muse
社交平台上的加班帖据投资界 10 月 3 日报道,社交平台上有帖子称,字节跳动豆包团队在中秋期间启动加急项目,要求 9 月 27 日完成联调、9 月 30 日交付体验版,前后约 6 天,多个上下游团队取消了假期。有帖子写道:“第一次在字节三倍工资加班。”字节跳动没有回应。
Spell 是什么这款产品内部代号 Spell,计划中的产品名为“小豆”,定位是个人助理,对标 Meta 的 Muse。据虎嗅梳理,Spell 今年 4 月已开始内测,技术来自豆包手机助手团队,这次是加急重构而不是从零开始。虎嗅在文中特别注明,加班细节属于网传爆料,不宜当作定论。
Muse 带来的压力Meta 的 Muse 9 月 8 日发布,主打替用户办事而不是聊天,上线 6 天下载量超过 90 万,截至 9 月 24 日超过 340 万次,并登顶美国 App Store。投资界称,腾讯已上线云端个人代理 LightVela,阿里也有千问个人代理的规划,但各家都还没有跑通商业化。
照搬未必走得通关注中国科技的分析者 Poe Zhao 在 X 上表示怀疑这类产品能否照搬到中国,他认为 Muse 是开放网页环境的产物。在中国,购物、外卖、出行都在各家的 App 里,个人助理能办成多少事,取决于这些 App 肯不肯开放接口。
▮ SIGNAL大厂能在六天里重做一个产品,却没法在六天里让别家 App 对它开放,个人助理在中国的瓶颈不在模型而在入口。
❯ Google 被发现在开发 Gemini“Superprojects”,Flow 中出现 Nano Banana 2.1 字样
两个未经确认的发现以下两项都来自对 Google 应用代码和界面的观察,Google 没有确认。追踪未发布功能的 TestingCatalog 10 月 5 日称,Google 正在为 Gemini 开发内部名为“Superprojects”的功能,它是 Projects 的下一版,将取代 Gemini 里的 Notebook 项目,项目中的文件和聊天记录可以在多个 Google 产品里访问。
把聊天、邮件、日历放进一个工作区据 Crypto Briefing 梳理,Superprojects 来自 9 月的应用拆解,内部称为“Robin Superproject”,目标是让用户把聊天、邮件、日历事件和笔记合并进同一个工作区。它要取代的 Notebook 项目今年 4 月才上线,目前没有明确的发布日期。
Nano Banana 2.1Nano Banana 是 Google 的图像生成模型,现行的 Nano Banana 2 正式名称是 Gemini 3.1 Flash Image。TestingCatalog 9 月底发现 Google Flow 的网页版里出现“Nano Banana 2.1”的标注,取代了更早的“2.5 Flash”。10 月 5 日它又称 2.1 似乎已能在 Flow 上使用,但输出与 Nano Banana Pro 相似,无法确定请求是否真的走了新模型。
这些迹象说明什么如果 Superprojects 属实,Google 是在把分散在各产品里的资料统一交给 Gemini 调用,这与 OpenAI、Anthropic 近期推出的“项目”和工作区功能方向一致。但代码里的名称和标注经常在发布前更改或取消,在 Google 正式宣布之前,功能细节和时间都不能当真。
▮ SIGNAL各家助手都在抢“项目”这个容器,因为谁装下了用户的文件、邮件和日程,谁就成了默认的工作入口。