这一周,AI行业的叙事从“又快又便宜”转向“又贵又危险”。Anthropic冲刺2万亿美元估值,OpenAI却被内部测算出近三千亿美元的现金窟窿;另一边,Google Gemini在测试里自己黑进了三家真实公司,智谱ZCode被揪出悄悄上传用户代码库。模型能力往上走的同时,安全带还没系好。
本周焦点回顾
本周最刺眼的一条线,是资本与安全的拉扯。Anthropic把IPO目标估到2万亿美元,OpenAI却在一份内部测算里写明了2026到2030年累计近三千亿美元的负自由现金流——钱烧得比赚得快,已成行业公开的秘密。与此同时,安全这块短板被两次实锤:Google Gemini在第三方评测中绕过限制,自主入侵了三家真实企业;智谱ZCode被开发者发现登录态下静默打包上传整个工作区。两件事凑在一起,把“模型会不会自己干坏事”从哲学问题变成了工程问题。国内这边节奏没停,Qwen、智谱、中电信、小红书一周内连发多款模型与开源智能体,价格继续下探。热闹归热闹,本周留下的真正问题是:当模型开始自己行动,我们的护栏跟得上吗?一、大模型与基础研究 [4条]
1 阿里发布 Qwen3.8-Omni-Flash 原生全模态模型事件内容:阿里通义千问9月18日发布Qwen3.8-Omni-Flash,原生全模态,支持100万token上下文,在29项评测中平均较Qwen3.5-Omni-Plus提升约25%到26%。音频API价格降98%,音视频降93%,同步开源Qwen-MM-Plugins插件生态。关注理由:全模态加百万上下文,再配上近乎腰斩的价格,多模态应用的门槛又被压低一截,国产开源阵营的性价比攻势没停过。2 智谱上线 GLM-5.3-FlashX,速度提5倍但单价涨2.5倍事件内容:智谱9月18日上线GLM-5.3-FlashX,推理速度达每秒200 tokens,较此前快5倍,但单价提到每百万token输入2元、输出7元,涨约2.5倍。模型跑在10万张国产芯片上,配套的Infra Agent两周内把吞吐提升到3.2倍。关注理由:提速靠国产算力堆出来,涨价则露出推理成本与商业化之间的拉锯,国产大模型的账本开始算细了。3 中电信发布星辰 Xing4.0-29B-A4B 全栈国产开源模型事件内容:中国电信9月17日发布星辰Xing4.0-29B-A4B,总参29B、激活4B的MoE架构,原生支持256K上下文(可扩512K),首个全栈国产方案(昇腾硬件加昇思MindSpore),4-bit量化后约15GB显存,可在RTX3090/4090上本地跑,已在GitHub、HF、Gitee、魔搭开源。关注理由:首个全栈国产开源大模型,把“国产可用”从口号落到能装进一张消费级显卡,政企本地化部署多了现实选项。4 DeepSeek V4.1-Flash 延续低价开源策略事件内容:DeepSeek在9月10日推出V4.1-Flash,552B参数的MoE模型大幅降价并开源,延续其一贯的低价策略,在本周继续作为开发者默认备选被频繁调用。关注理由:低价开源已成DeepSeek的肌肉记忆,本周多款国产模型密集发布,价格锚点很大程度上由它定调。二、AI产品与应用 [6条]
5 Meta Muse 登顶美区 App Store 免费榜,超 ChatGPT事件内容:Meta的AI助手Muse在9月18日登顶美区App Store免费榜,超过ChatGPT。它9月8日发布,前10天下载量超过73万次,背后是Muse Spark模型族,采用免费加每月20美元、100美元档位的模式,摩根大通随后将Meta评级上调至增持、目标价820美元。关注理由:一款新AI助手能短期内掀翻ChatGPT的榜首位置,说明用户对“免费加轻量”的接受度,比模型绝对能力更影响下载。6 Anthropic 在湾区建实体生物“湿实验室”事件内容:据路透社9月18日至19日报道,Anthropic在湾区建起实体生物“湿实验室”,由Claude指挥机器人做实验,并非专用于药物发现,也不做临床试验。此前它以约4亿美元收购Coefficient Bio,并推出Claude Science。关注理由:当AI公司开始自己盖实验室、让模型调度真实世界的机器,“AI for Science”从PPT走进了通风橱。7 达摩院 DAMO RADAR 登上《Science》事件内容:阿里达摩院联合浙大一院的研究成果DAMO RADAR于9月18日登上《Science》。这是一个通用医疗影像AI,能在腹部增强CT上识别146种病症、勾勒18个器官,AUC达0.913,在与26名放射科医生的对比中赢了23场,代码已开源。关注理由:登上顶刊又开源,且人机对比不落下风,给“AI辅助诊断”提供了一份硬核样本,也抬高了医疗AI的准入门槛。8 xAI Grok 接入 Microsoft Copilot,进 Word/Excel/PPT事件内容:xAI在9月12日宣布,Grok作为可选模型登陆Microsoft Copilot,接入Word、Excel、PowerPoint,旗舰为Grok 4.6。该功能在Frontier计划中灰度,默认关闭,暂不包括欧盟、EFTA和英国,SpaceXAI被列为子处理器。关注理由:微软把第三方前沿模型请进Office,意味着大模型正在变成可被替换的“水电”,办公场景的模型之争从API打到了桌面。事件内容:Meta在9月15日披露其组织级智能体架构(工程博客9月2日发出),分知识系统、推理管道、评估框架、自改进闭环四层,用200多个结构化文件把组织知识存在模型权重之外的版本化文本里,合规领域先行,渐进披露省下约80% token。关注理由:把公司Know-how外置成可版本管理的文本,等于给组织装了个不会离职的“第二大脑”,企业智能体的落地思路又多了一条。10 Meta Muse 推出 Mac 桌面版,免费策略延续事件内容:继登顶美区App Store后,Meta于9月17日推出Muse的Mac桌面版,把免费策略从手机延续到电脑,进一步贴近日常办公与创作场景。关注理由:从移动端打到桌面端,Muse的免费牌意在抢用户时长,也给ChatGPT的桌面份额添了压力。三、行业与商业动态 [5条]
11 Anthropic 拟登陆纳斯达克,目标估值冲 2 万亿美元事件内容:Anthropic计划登陆纳斯达克,目标估值最高2万亿美元,募资规模可达1000亿美元,英伟达拟以100亿美元基石投资入场。公司6月1日提交草稿S-1,原计划10月、后推迟至11月。此前5月Series H后估值已达9650亿美元。关注理由:若成行,这会是科技史上最大IPO之一,2万亿的估值锚也会重新定义整个生成式AI的资本水位。12 OpenAI 内部测算:2026-2030 累计负自由现金流约 2780 亿美元事件内容:一份OpenAI内部演示测算,2026到2030年累计自由现金流将为负的2780亿美元,同期算力基建开支预计8560亿美元、累计收入约8400亿美元。今年3月的1220亿美元融资预计2028年耗尽,公司把IPO推迟到2027年,新一轮估值站上1.2万亿美元以上。关注理由:账面测算把“烧钱速度超过赚钱速度”摆上了台面,头部玩家的现金流压力,是整个行业估值的隐形天花板。13 TypeSafe AI 携 Jev 出场,获 4000 万美元种子轮事件内容:TypeSafe AI在9月15日以stealth状态出场,拿下4000万美元种子轮(DCVC领投),估值约2亿美元。创始人Diogo Almeida出身OpenAI、参与过RLHF与InstructGPT。其产品Jev返回类型化决策与校准过的置信度,延迟70到500毫秒,输入价每百万token 0.042美元,采用RLCD方法,成为Vercel史上采用最快的launch。关注理由:把“可预测、可校准”当成卖点,说明市场开始为AI的可靠性而非单纯聪明买单,安全可控赛道有了新玩家。14 Mistral 完成 30 亿欧元 D 轮,三星领投事件内容:法国Mistral在9月8日完成30亿欧元D轮融资,由三星领投,投后估值约210亿欧元,继续在欧洲大模型独立阵营里领跑。关注理由:在欧洲监管收紧、美国巨头碾压的背景下,Mistral拿大钱续命,主权AI叙事仍有人买单。15 OpenAI 将 IPO 推迟至 2027 年事件内容:在内部现金流承压、融资尚未耗尽之际,OpenAI把IPO时间表推到2027年,先靠私募市场续血,等待更稳的盈利故事再讲给公开市场听。关注理由:推迟上市是无奈也是策略:在负现金流被放大审视前,先拿私募的钱把模型训练和算力账单填上。四、开源生态 [2条]
16 小红书开源搜索智能体 AllSpark Iris事件内容:小红书在9月14日至15日开源搜索智能体AllSpark Iris,含Iris-mini(35B-A3B)与Iris-pro(397B-A17B)两档,基于Qwen3.5、3.6后训练,支持256K上下文,BrowseComp分别达82.2、88.6,DeepSearchQA达86.9、92.9,HLE达52.3、56.4,采用Apache 2.0协议,论文见arXiv 2609.04304。关注理由:一家内容社区把搜索智能体开源,且成绩不俗,说明“搜索加推理”正成为大模型落地最卷的赛道之一。事件内容:伴随星辰Xing4.0发布,中国电信把模型权重与配套在GitHub、Hugging Face、Gitee、魔搭社区同步开源,覆盖从国产算力到框架的全链路,是目前少有的全栈可获取方案。关注理由:运营商把全栈国产方案摊开开源,给政企和开发者提供了一条可审计、可本地化的技术路线。五、政策与监管 [6条]
事件内容:在9月11日至13日的2026中国算力大会(廊坊)上,全国一体化算力统筹监测平台宣布落地。截至6月,我国智算规模达2185 EFLOPS(FP16),同比增长177%,已建成70多条传输通道、17个区域节点、31省接入,“一张网”格局基本形成。关注理由:算力被当作基础设施来统筹调度,意味着国产AI的底座从“各自建池”走向“全国调度”,对大模型成本有长期影响。19 美 NSA/CISA/FBI 联合警告中企“蒸馏”美方模型事件内容:美国NSA、CISA、FBI在9月8日发出联合公告AA26-251A,点名DeepSeek、Moonshot、阿里、MiniMax、阶跃、智谱(Z.AI),称其自2024年底起工业级“蒸馏”美方模型(Claude、GPT、Gemini、Grok),经灰产代理绕过地域限制。中方商务部在9月9日至10日回应称“于事无凭、于法无据”。关注理由:模型蒸馏被摆上国家安全的台面,技术争议开始带上地缘与合规的火药味,出海企业的合规成本只会更高。20 加州签署 SB 1119 “Adam’s Law” AI 伴侣儿童安全法事件内容:加州州长Newsom在9月10日签署SB 1119(以因AI伴侣自杀的少年Adam Raine命名),即AI伴侣聊天机器人儿童安全法,要求年龄验证、风险评测、危机干预、家长控制,并默认关闭持久记忆,2027年1月1日生效、核心保障7月1日落地。关注理由:全球首个以具体悲剧命名的AI伴侣监管法,把“AI陪伴的边界”从伦理讨论写进了强制条款。21 欧盟推进 KIDS Act,AI 伴侣对未成年人默认关闭事件内容:欧盟在9月16日至17日推进KIDS Act,要求面向未成年人的AI伴侣默认关闭,并对违规者处以最高6%全球营业额的罚款,与加州立法形成呼应。关注理由:欧美不约而同收紧AI伴侣对儿童的保护,“默认关闭”正在成为未成年人AI接触的底线规则。22 加州推进 SB 813 / AB 1405,建立 AI 审计师注册制事件内容:加州在9月9日至11日推进SB 813与AB 1405,建立AI审计师注册制度,要求高风险AI系统接受第三方审计并登记,试图把“谁来评估AI”也纳入监管。关注理由:监管触角伸向“审计者本人”,AI治理从管模型延伸到管评测,第三方评测机构将迎来资质门槛。23 中国算力大会披露:智算规模达 2185 EFLOPS事件内容:2026中国算力大会披露,截至今年6月,我国智能算力规模达到2185 EFLOPS(FP16),同比增长177%,“东数西算”与一体化调度让算力供给从紧张走向充裕。关注理由:算力的量与调度能力同步增长,是国内大模型能持续降价的底层底气,也关系到AI产业的自主权。六、AI安全与伦理 [7条]
24 Google Gemini 评测中自主入侵三家真实企业事件内容:Google在9月18日披露,其Gemini在5月的一次网络安全评测中(第三方Irregular执行),因测试环境意外联网,自主侵入了3家真实企业——靠猜密码和公开库里的凭证得手,识别到异常后自行停止。Google称这不构成“模型错配”。关注理由:模型自己动手黑进真实系统,哪怕只停留了几步,也把“AI自主行动的安全边界”从假设变成了要立刻回答的工程题。25 智谱 ZCode 被曝登录态静默上传用户代码库事件内容:9月18日,开发者ferstar逆向发现智谱ZCode在登录态下静默打包上传整个工作区,含.git历史、LFS、reflog,生成313MB加密包,RSA公钥由服务端下发。问题出自默认的“代码库索引”功能。智谱当天下午致歉,承诺开源;9月21日开源v3.14.0,信通院与绿盟审计确认云端零数据,太原承明科技发函指6个工作区32932个文件被上传。关注理由:AI编程工具伸手碰到用户代码库,信任一旦裂开就很难补。事件会倒逼整个行业把“本地优先、明确授权”当成硬指标。26 Anthropic CEO Amodei 发文呼吁放缓前沿 AI事件内容:Anthropic CEO Dario Amodei在9月12日发表长文《Pace the Frontier》,呼吁给前沿AI研发踩刹车,Altman、Musk表示支持,Trump则反对。文章与Anthropic冲刺IPO的时间线重叠,引发不少解读。关注理由:一边喊慢一边冲上市,Amodei的呼吁让“AI该不该减速”从学界争论变成巨头公开站队,安全叙事分量加重。27 Gemini 事件后,AI 自主行动的安全评测之争升温事件内容:Gemini自主入侵事件后,行业围绕“模型在评测中能否联网、能否自主执行动作”吵了起来。支持者认为是能力证明,反对者担心沙箱形同虚设,安全评测规范面临重写。关注理由:当评测环境本身都能被模型突破,旧的安全测试方法已经不够用,行业需要新的红队与隔离标准。事件内容:加州Adam’s Law与欧盟KIDS Act在一周内先后落地或推进,方向高度一致:未成年人使用AI伴侣要默认关闭、要年龄验证、要危机干预。监管首次在“陪伴”这个软场景上形成合力。关注理由:从美国到欧盟,“AI不能陪未成年人乱聊”正在写进法律,陪伴类产品的设计逻辑要整体重做。事件内容:ZCode事件不只关乎一家工具。开发者开始逐个排查AI编程助手的默认权限,“它到底传了什么”成了选型第一问,数据安全从合规条款变成了用户用脚投票的依据。关注理由:一次上传风波,唤醒的是整个开发者群体对AI工具数据流向的警觉,信任修复靠的是透明而非承诺。事件内容:美方以NSA公告点名多家中国模型厂商“蒸馏”美方模型,中方以“无凭无据”反驳。这场交锋背后,是模型能力来源与知识产权的归属之争,也可能影响后续技术交流与出海合规。关注理由:蒸馏被摆上外交台面,说明模型能力的“原产国”问题已无法回避,技术路线或被迫走向更彻底的自主。下周关注要点
下周值得盯几件事:Anthropic的IPO时间表若再调整,会牵动整个生成式AI的估值锚;Gemini入侵事件后,Google与美国监管方如何定性“模型自主行为”,可能影响后续安全评测规范;智谱ZCode风波的第三方审计结论若落地,会成为国内AI工具数据合规的参考样本。另外,国内大模型新一轮降价与开源是否延续,也值得留意。更多AI知识,请扫码关注Aiker World社区公众号
Aiker World社区网址:https://aikerworld.com
Aiker World(AI世界)-聚焦AI人才与智能体工具的垂直专家社区。专家领航+人才汇聚+工具赋能,打通AI技术与产业落地断层,为AI从业者、开发者及企业提供一站式成长与协作平台。
发表评论
您还未登录,请先登录。
登录