← 全部标签

#DeepSeek

83 条相关报道 · 46 期日报 · 每日更新的 DeepSeek 新闻时间线


#DeepSeek 时间线 · 新到旧
2026-10-01-星期四
DeepSeek 联手华为开源昇腾编程工具,国产芯片训练生态补上关键一环
芯片自主的难点从来不只在造出芯片,而在让开发者愿意为它写代码,DeepSeek 正在替华为补上这道最难的软件题。
阿里魔搭和开源中国模力方舟争做中国版 Hugging Face
开源模型本身免费,争夺的是开发者第一次下载它的地方,因为那里往往也是他们第一次付钱买算力的地方。
2026-09-30-星期三
月之暗面 K3.1 在 API 平台露面,传将支持百万 Token 上下文并于下月推出
中国模型公司的迭代正从“追上一个分数”转向“把同一个模型拆成不同价位卖”,定价设计开始和模型能力一样重要。
DeepSeek Harness v0.2 预览版推出桌面安装包,智能体工具不必再靠命令行启动
智能体工具的竞争正在从“谁的模型写代码更强”下沉到“谁的安装包更好装、插件更好找”,桌面入口成了新的必争之地。
2026-09-25-星期五
DeepSeek 年化收入运行率达 10 亿美元,正筹集约 75 亿美元
模型公司的商业化要同时证明两件事:有人愿意持续付费,而且每增加一笔收入,不必付出同样多的算力成本。
2026-09-24-星期四
梁文锋署名论文公开 DeepSeek 智能体训练系统 DSec,每秒可创建 5000 个沙盒,峰值同时运行 38 万个
智能体训练的瓶颈正在从 GPU 转向 CPU 和环境调度,DeepSeek 把这套底座公开,说明它认为这部分已经不是护城河。
2026-09-23-星期三
梁文锋闭门会透露 DeepSeek 在训 2 万亿参数模型,计划做到 8 万亿
以省算力出名的公司开始报万亿级参数,中国大模型的竞争单位已经从效率换成了规模。
特朗普在联大宣布美国文件改用"超级智能",DeepSeek 将向安理会简报
联大讲台上拒绝约束,安理会里请企业谈风险,全球 AI 治理这周同时收到了两个相反的信号。
小米 MiMo-V2.6-Pro 登顶开放权重模型榜,与 Grok 4.7 同分
300 万美元训出与 Grok 4.7 同分的开放模型,前沿能力的入场费正在被一家手机厂商重新标价。
2026-09-22-星期二
The Information 称 DeepSeek 拟用华为芯片训练,交付窗口指向今年末或明年初
国产算力能否从推理走进顶级模型训练,要看连续运行的集群表现,不看单次芯片交付。
OpenRouter 数据测算显示中国模型周调用量达 67.46 万亿令牌,统计口径须谨慎
令牌份额能展示模型被试用和调用的热度,商业份额还要看谁付费、按什么价格付费。
2026-09-17-星期四
DeepSeek工程师刘胜与谈“转业”,顶尖算子优化开始让位于AI协作
AI先吃掉的可能不是工程师职位,而是高手每天重复投入的那部分手工优化时间。
2026-09-16-星期三
DeepSeek官方桌面代码已公开,支持Mac与Windows构建
官方桌面端的可确认进展是构建与更新链路,正式安装包可用性和同任务性能仍需分别验证。
2026-09-15-星期二
DeepSeek让V4.1 Flash扛下大版本变化,爆料称9月还将发布3万亿参数Code 2.0
版本号不再标记能力跃迁,选型表上要换的是单位成本那一栏。
高瓴创投合伙人严文韬或将出任DeepSeek首任CFO,该岗位竞聘已持续数月
一家估值5000亿元的公司补上财务负责人,通常说明资本动作已进入排期。
2026-09-12-星期六
DeepSeek V4.1 Flash上线首日出现适配差,英伟达六类GPU率先跑通vLLM
新模型发布把芯片竞争压缩到小时级,首日能否提供可用镜像,已经和硬件性能一样影响开发者选择。
DeepSeek App新增四种朗读声音,新TTS模型仍停留在外界猜测
四种新声音是明确的产品变化,底层是否换成新模型仍没有证据,功能上线与模型发布必须分开写。
2026-09-11-星期五
DeepSeek发布V4.1 Flash,5520亿参数新架构瞄准更低推理成本
DeepSeek把新架构先落在低价Flash型号上,市场会用真实任务成本检验这次效率升级。
DeepSeek Harness 0.1.5上线,模型优化与插件文件工作流同步扩展
DeepSeek正把模型升级同步压进智能体运行环境,开发者拿到的不只是新模型,还有更完整的产品接口。
2026-09-10-星期四
DeepSeek 据报接洽中信证券筹备科创板上市,可能今年启动流程,发行规模尚未确定
上市筹备提供了潜在融资路径,正式文件中的收入、成本与资本需求才会让外界看清模型业务的经济性。
DeepSeek 拟在 V4.1 Flash 上线后将 V4 Pro 请求转至新模型,并按 Flash 价格计费
后台替换降低了迁移动作,却把版本识别和回归测试的重要性留给了开发者,账单下降与任务稳定要一起验收。
2026-09-09-星期三
DeepSeek V4.1 Flash 开启限时内测,称采用新结构并原生支持多模态,正式技术细节尚未公布
限时内测提供了验证新结构的窗口,能力、速度和成本三项改善,都需要在同一套真实任务上分别测量。
DeepSeek 将于9月10日中午下调 Flash 价格,缓存输入降至每百万令牌 0.02 元,高峰仍收双倍
缓存降价最多,但应用实际能省多少,仍由缓存命中率、输出长度和高峰时段占比共同决定。
DeepSeek 拟招聘约150名资深后端工程师,重写逼近承载上限的基础系统以支撑用户和智能体增长
用户增长把后端工程推到前台,扩招的成果应体现在更稳定的任务交付,而不只是更大的团队规模。
2026-09-07-星期一
DeepSeek 拟在乌兰察布部署 16 万颗昇腾 950DT 跑推理,训练仍用英伟达
训练留在英伟达、推理搬去国产,这条分工线画在哪,就是中国算力自给真正的进度条。
2026-09-05-星期六
消息称 DeepSeek 拟在内蒙古部署超 16 万颗华为昇腾 950DT
16 万颗昇腾放在一家实验室名下,国产算力从「能用」进入「被主力实验室押注」的阶段。
2026-09-01-星期二
智谱上半年营收增长 400% 至 9.54 亿元,仍低于自身 2 亿美元预期
营收翻四倍、股价腰斩六成,中间那道缺口就是市场对中国大模型公司叙事的重新报价。
DeepSeek 开源 V4-Flash-Vision-Exp 权重,305B 参数采用 MIT 许可证
305B 权重加 MIT,最先感到压力的不是 OpenAI,是所有按调用量收钱的国产多模态接口。
2026-08-28-星期五
DeepSeek 将以 740 亿美元估值募资 74 亿美元,投向算力基建
自建机房这一步迈出去,DeepSeek 的低成本就不再只是算法命题,而是资本开支命题。
2026-08-27-星期四
智谱开源 GLM-5.3-Flash,公测流量全部跑在国产芯片集群上
这次的分水岭不在跑分,在于一个前沿量级的模型第一次证明自己能脱离英伟达供货节奏活着。
阿里开源 Qwen3.8-Flash-Next,125B 模型每 token 只激活 60 亿参数
训练开销砍到九分之一这个数字,比任何一项跑分都更能说明下一代 Qwen 想赢的是哪场仗。
路透独家:月之暗面就 Kimi K3 托管向三大云厂商索要三成分成
分成谈的从来不只是钱,而是中国模型要不要在美国云上拿到一个有名有姓的供应商身份。
DeepSeek 前七月收入 7070 万美元,API 业务毛利率高达 82.9%
82.9% 的 API 毛利率证明推理生意本身能赚钱,问题从来是免费那一半谁来埋单。
2026-08-24-星期一
英伟达 70 亿美元买下 Poolside 技术与团队,自建开源模型对标 DeepSeek
芯片公司自己下场做最强开源模型,卖的从来不是模型,是让所有人都在自家硬件上跑推理的那个默认选项。
DeepSeek 调整 API 计费,周末全时段按低谷价收费
定价表松动的地方,往往就是产能过剩最先露头的地方。
2026-08-22-星期六
OpenAI 把 GPT-5.6 Sol 输入价降到每百万令牌 4 美元,降幅超两成
三个月限期降价不是促销,是 OpenAI 在给自己留一个随时再调的口子。
DeepSeek 上线实验性多模态模型 V4-Flash-Vision-Exp,单次可读 600 张图
自家 Harness 跑出来的对标数字,参考价值取决于第三方多久能复现出来。
腾讯下一代大模型 Hy4 现身内测界面,参数规模将大于 295B 的 Hy3
内测界面上自研与开源并列摆着,腾讯没打算在这两条路里选一条。
2026-08-21-星期五
DeepSeek Harness 发布 rc.8 版本,补齐图片输入与子代理安装
把图片翻译成文字再喂给文本模型,是在模型能力追上来之前,用工程手段先把路铺通。
2026-08-18-星期二
DeepSeek API 启用峰谷分时定价,V4 Pro 高峰输出涨至每百万 tokens 27 元
当 API 开始按峰谷计价,算力就正式变成了一种公用事业。
2026-08-17-星期一
DeepSeek 开源智能体框架 Harness,两天获 9.5 万 GitHub 星标
开源一套运行时的真正标的,是让别人的工程习惯长在你的抽象上。
2026-08-15-星期六
DeepSeek 开源 agent 框架 Harness:一切组件皆可插拔
模型之外,agent 运行时正在成为下一个被开源攻占的层。
2026-08-14-星期五
DeepSeek 发布 V4-Pro,定价只有 Kimi K3 的七分之一
标价打一折、缓存涨十倍,DeepSeek 把价格战打成了价格结构战,比价的复杂度全转嫁给了开发者。
DeepSeek 开源智能体框架 Harness,主打「一切皆插件」
模型免费化、框架开源化之后,智能体赛道真正稀缺的资产只剩用量入口和插件生态的主导权。
2026-08-13-星期四
xAI 发布 Grok 4.6,智能指数追平 GPT-5.6 Sol,价格维持 2 美元不变
智能差 1 分、价格差 8 倍,高价档位得给出一个新的解释。
DeepSeek 悄然上架 V4-Pro-0813,100 万上下文、38.4 万最大输出
便宜四倍的旗舰模型自带一句涨价预告,成本模型要留出这一栏。
Fable 5 上线首月吃下 Anthropic 11.4% 收入,token 量只占 6%
用量 6%、收入 11.4%,高价模型卖的是任务价值不是调用次数。
2026-08-12-星期三
DeepSeek注册「DeepSeek Harness团队」公众号,主体为北京深度求索
从发模型到发产品,中间隔着的正是一个能天天面试、能开公众号的组织。
2026-08-10-星期一
DeepSeek V4-Flash 0731 第三方评测出炉:激活参数仅 13B,智能体成绩反超自家 Pro 版
后训练重做一遍就反超高价版,说明智能体能力的门槛正在从"堆参数"移向"炼配方"——这恰恰是开源阵营追赶最快的一段。
宇树科技明日申购:发行价 150.80 元,网下申购倍数 2618 倍,DeepSeek 参与战略配售
DeepSeek 入股宇树,把"大脑"与"身体"的合流从论坛话题变成了股权结构。
2026-08-08-星期六
宇树科技战略配售名单出现深度求索,王兴兴称将获模型架构与智算集群支持
硬件公司补脑子,最省事的办法是让做脑子的那家成为股东。
2026-08-07-星期五
DeepSeek 后台公告称 API 将大幅涨价,国产大模型低价时代出现拐点
价格屠夫自己抬价,说明支撑低价的那本账已经算不平了。
MiniMax 开源新一代多模态模型 H3,登顶 Hugging Face 热度榜
八家国产芯片同日适配,比榜单第一更能说明 MiniMax 攥住了什么。
宇树科技公布战略配售名单,DeepSeek 获配约 1.41 亿元
模型公司出钱买本体股权,具身智能的上下游正在互相长进对方的地盘。
2026-08-06-星期四
Meta 发布首个编码智能体 Muse Code,输出价定在每百万令牌 4.25 美元
编码模型的价格战开打了,第一枪打在别人的毛利上,子弹是数据。
DeepSeek 重启第二轮融资,拟募 500 亿元、投前估值约 5000 亿元
一万亿意向资金追 500 亿额度,稀缺的从来不是钱。
2026-08-05-星期三
阿里发布 2.4 万亿参数 Qwen3.8-Max,称下周放出 Max 级开放权重
值钱的不再是某一次发布,而是那张一个月一更的排期表。
DeepSeek 新版 V4-Flash 跑分追平 GLM-5.2,价格只有对方十分之一
当追平跑分只要十分之一的价钱,中间档 API 就没有故事可讲了。
2026-08-04-星期二
Artificial Analysis 测算:DeepSeek V4-Flash 单次任务成本 3 美分
每百万 token 的报价正在失去参考价值,值钱的是完成一件事的总账单。
2026-08-03-星期一
DeepSeek V4-Flash 正式版上线,输出价降到每百万 token 2 元,为 Pro 的三分之一
便宜模型追上贵模型的那一刻,被淘汰的不是贵模型,是模型路由这门生意。
OpenRouter 周调用量前五全是中国模型,小米 MiMo-V2.5 以 10.5 万亿 token 登顶
开源不是让利,是把分发渠道从别人的控制台搬到自己手里。
2026-08-01-星期六
DeepSeek 发布 V4-Flash 正式版:权重当天开源,智能体测评反超自家 Pro 预览版
同一个模型跑两遍,第二遍多值 10 分——后训练正在变成比参数量更值钱的资产。
小红书拟在内蒙古乌兰察布建 22 亿美元数据中心,规模 600 兆瓦
电买得到、卡买不买得到,是两张不同的表。
智谱重开 GLM 编程套餐订阅,计费改为积分制,每月 118 元起
一边把权重免费送,一边把订阅提价两倍多,两家赌的其实是同一件事:钱不在模型里。
2026-07-31-星期五
消息人士称 DeepSeek 拟在内蒙古乌兰察布建 1 吉瓦数据中心
靠效率省下来的钱,最后还是要变成电和机房。
2026-07-27-星期一
月之暗面 Kimi K3 掀起新一轮 DeepSeek 时刻,杨植麟启动港股上市
榜单第一是短期新闻,把同等能力的价格砍到一半才是持续的压力。
DeepSeek 暂停第二轮融资,梁文锋闭门讲话外流后在网上走红
74 亿美元的资金没有卡住这轮融资,一段被转发出去的私下发言卡住了。
2026-07-17-星期五
Mira Murati 的 Thinking Machines 开源 Inkling,成美国最大开源权重模型
Inkling 的筹码不在榜单名次,在那张 Apache 2.0 许可证上。
中国上市公司备案曝光 DeepSeek 首轮外部融资定价,估值约 520 亿美元
一家箱包公司 0.0114% 的持股,捅出了 DeepSeek 捂了一年半的价格。
长鑫科技科创板 IPO 散户认购超额 212 倍,幻方量化 150 只产品参与报价
模型层的估值靠故事,存储层的估值靠中签率——后者更难撒谎。
2026-07-16-星期四
DeepSeek 拟以约740亿美元估值融资74亿美元,年化收入冲5亿
真正被定价的是 DeepSeek 从研究室走向上市公司的那份确定性。
中国称 Apple Intelligence 已注册可用,将整合阿里通义千问
苹果在中国的差异化叙事,要等 Apple Intelligence 真正上线才算补齐。
2026-07-15-星期三
DeepSeek 据报启动 IPO 筹备,最快年底递表并寻求 710 亿美元估值融资
一级市场可以自己给自己讲估值,二级市场不行——DeepSeek 递表那天,中国 AI 的估值体系才第一次要接受外部检验。
2026-06-30-星期二
DeepSeek V4 正式版定档 7 月中旬,API 引入分时定价高峰翻倍
大模型 API 第一次像电费一样分峰谷,省钱的关键从选模型变成选时段。
DeepSeek 开源 DSpark 投机解码框架,V4 推理最高提速 85%
不动模型权重就把推理提速近一倍,DeepSeek 把降本的战场推到了工程优化层。
2026-06-29-星期一
DeepSeek 系初创 DSpark 发布投机解码框架,推理提速 85%
当硬件红利被封住时,推理效率就成了中国 AI 公司的新算力——DSpark 这套框架卡的点恰好是这个缺口。
2026-06-27-星期六
据称 Mythos 发布促使 DeepSeek 启动 74 亿美元首轮外部融资
前沿 AI 的军备竞赛正从「烧自有资金」进入「全员募资」——开源与闭源在同一条资金轨道上竞争。
智谱发布 GLM-5.2 编程模型,首次跻身全球基准前三
中国大模型的竞争策略正在从「追平」切换到「在编程等单点赛道冲前三」——这比泛泛的「综合能力追赶」更具实际威胁。
2026-06-26-星期五
DeepSeek发起招聘冲刺欲将团队规模翻倍,押注通用人工智能
DeepSeek这次扩的不是模型团队,而是整套AGI生态的人手,押注的变量从模型能力换成了组织规模。
2026-06-19-星期五
GLM-5.2 成开源权重最强模型,智能指数 51 分列总榜第四
开源与闭源的差距不再以代际计,而是以个位数的分差计——这才是闭源厂商真正要警惕的信号。
DeepSeek 识图模式正式上线 App 和网页端
当以文本推理见长的 DeepSeek 也补齐视觉,多模态正从国产大模型的卖点退化为标配。
2026-06-17-星期三
DeepSeek完成首轮74亿美元融资,估值超500亿,梁文锋设LP结构锁死控制权
梁文锋用LP结构解了一道几乎所有创始人面对的方程:拿大钱,但不交权。代价是让投资人变成”只出钱、不说话的乘客”。
腾讯2000万美元入股林俊旸AI实验室,天使轮估值即达20亿美元
中国AI人才争夺已从薪资战升级为”天使轮估值战”——顶级研究员创业的第一个数字不再是年薪,而是十亿美元起跳的投后估值。
// 相关标签 — 常与 #DeepSeek 同期出现