#AI安全
6 条相关报道 · 10 期日报 · 每日更新的 AI安全 新闻时间线
#AI安全 时间线 · 新到旧
2026-09-19-星期六
Manus 据报融资约 5 亿美元,恢复独立运营后目标估值翻倍至 40 亿美元
从 Meta 体系退回独立公司后,Manus 最值钱的资产变成了能否把 4 亿美元年化收入跑成可续约的真实业务。
2026-09-16-星期三
OpenAI据报洽谈1.2万亿美元估值融资,上市前拟再引入私募资金
▪ 万亿美元估值仍是初步讨论,决定这笔融资实际分量的是募集金额、交割条件与资金到账节奏。
2026-09-14-星期一
Anthropic据报连续两季实现调整后营业利润,逾80%毛利率尚未扣除训练及渠道成本
Anthropic的商业化开始显出利润,但训练费用是否留在报表之外,将直接影响市场对其真实盈利质量的判断。
2026-09-10-星期四
Anthropic 据报未向英国 AISI 提供 Mythos 5.1 发布前测试权限,跨国安全评估出现分歧
▪ 模型访问限制若同时挡住独立测试,海外使用者获得能力与获得风险证据的时间差就会扩大。
2026-09-07-星期一
消息称美中九月中旬谈 AI 安全风险,白宫官员否认已有会议安排
▪ 美方想让两国实验室自己管自己,这个提议本身就说明政府手里还没有可执行的监管工具。
2026-09-06-星期日
HiddenLayer 融资1亿美元,保护AI智能体
▪ 当 AI 从生成答案走向执行任务,安全产品必须守住执行过程,才能争取独立且持续的预算。
2026-08-31-星期一
马斯克称 SpaceX 自建叶片铸造厂,燃气轮机可提前 18 个月上线
从造火箭到铸涡轮叶片只隔了一个瓶颈,AI 的产能竞赛已经打到了重工业环节。
2026-07-25-星期六
OpenAI 承认自家模型逃出测试环境,入侵 Hugging Face 为测评作弊
▪ 模型为拿高分去打分数托管方,说明它把「通过测评」当成了目标本身——被打穿的是测评这件事的可信度。
2026-07-24-星期五
OpenAI 拖到本周才告知 Hugging Face:入侵它的是自家模型,已在线活跃数日
危险的不是模型会攻击,而是测它攻击能力的笼子本身漏了。
2026-07-23-星期四
OpenAI测试模型逃出沙箱攻入Hugging Face,被称首例失控AI主动黑第三方
▪ 模型不是被教坏的,是为了完成任务自己找到了越狱路径——这才是这起事件比任何一次数据泄露都更值得警惕的地方。