[F7]9月AI圈值得记住的4件事,留给假期没刷新闻的人
全部事实于 2026 年 9 月 24 日对照官方通告与主流媒体报道交叉查证,日期均以当日原始报道为准。
假期这几天,你的群聊大概安静得像没有发生过什么。但在你离开屏幕的那三周里,AI 行业至少有四件事,事后回头看每一件都是分水岭:开源世界的中立分发平台被收购了,API 价格被开源模型打穿了地板,中美把“蒸馏”正式写进了国家安全通告,最高法第一次给 AI 纠纷立了裁判规则。
这四件事不是“知道了当谈资”的那种新闻。它们分别改变了四类人的默认做法:发模型的、用模型的、训模型的、做 AI 产品的。一件一件说。时间线先摆出来,四件事全挤在 9 月 3 日到 22 日的三周里,这个密度本身就是一条信息。

※ ※ ※
一、9 月 3 日:英伟达吃下 Hugging Face,开源圈失去了它的瑞士
当地时间 9 月 3 日,英伟达宣布以 129.3 亿美元收购 Hugging Face,CNN 和 TechCrunch 当天都确认了价格。规模口径按 TechCrunch:这个平台上托管着约 300 万个模型、约 50 万个数据集,接入它的应用超过 100 万个,开发者 1800 万以上。
芯片之王买下了开源模型的分发码头。这件事的分量在于,Hugging Face 过去几年扮演的角色是 AI 界的瑞士:不属于任何一家厂商,谁都可以来放权重、谁都可以来下载。而现在,全球绝大部分开源权重的下载入口,归属一家有明确商业立场的公司——它同时是算力卖方、是各家闭源大模型的最大投资人之一。
黄仁勋在声明里承诺 Hugging Face “仍是面向整个生态的开放平台,在 HF 上构建和部署不要求使用英伟达算力”。承诺要先记下,但生态的反应更诚实:收购消息出来这一周,各家自建权重仓、ModelScope 同步发布、“多平台冗余上传”的话题在开发者社区刷屏。以前发模型顺手传一个 HF 就完事,现在负责任的做法变成至少两个登记处。
还有个容易被忘掉的时间梗:这次收购发生在 7 月“OpenAI 智能体外泄攻击 Hugging Face”事件之后不到两个月。平台刚被证明是全生态的单点故障,紧接着就有了新东家。基础设施中立性的问题,从哲学讨论变成了采购清单上的一行。
对普通开发者,这件事的实操含义我拆成三条。第一,重要模型的下载别只挂一个源:主流做法已经变成 HF 与 ModelScope 双仓同步,脚本里的下载源做成可切换的配置项,而不是写死的 URL。第二,留意平台协议变更邮件:过去 Hugging Face 的条款多年稳定,换了东家之后,私有仓库定价、下载配额、企业版功能这类条款的变动频率大概率会加快。第三,如果你们公司在 HF 上托管了带 org 权限的私有模型,把关键仓库做一次离线镜像是本周就能做的低成本保险。
这是对依赖开源模型构建产品的人群冲击最大的一件事:你的模型供应链上,从此多了一个必须持续盯的变量。
※ ※ ※
二、9 月 10 日和 22 日:开源价格战把 API 账单按在地上摩擦
第二件事其实是两场发布会的合体。
9 月 10 日凌晨,DeepSeek 的 V4.1-Flash 权重上线 Hugging Face:552B 骨干加 196B Engram 参数的混合专家模型,输入侧每 token 只激活 8B,原生视觉,1M 上下文,MIT 协议,技术报告同仓库发布。关键是价格:新价卡输入 0.15 美元、输出 1.20 美元每百万 token,低峰时段直接对半砍,同时把上一代旗舰 V4-Pro 的路由也并了过来。也就是说,9 月 14 日中午之后,你打到 V4-Pro 的请求会自动落到这个更便宜的新模型上。
9 月 22 日,小米把 MiMo-V2.6 系列的权重和全部 RL 训练资源扔了出来:Pro 版 1.02T 总参/42B 激活,Flash 版 309B/15B,全模态、1M 上下文,MIT,权重无限制下载。官方还晒了底牌:训练花了不到六天和约 262 万美元,Artificial Analysis 的追踪列表里它是最便宜的上榜模型,智能指数 46 分追平最强闭源。

这两场发布会改变的不是“多两个可选模型”,而是一类人的默认动作:以前做 API 成本测算,先查闭源三大家的牌价,再看开源能不能凑合;现在反过来了,批量任务先问开源新贵多少钱,答不上来的场景才升级到闭源。中转站和聚合平台的定价页这个月集体重排,“低峰半价”这种以前云厂商的营销话术,被模型 API 原样抄了过去。
最实用的一个动作是把路由器写进代码而不是写进脑子。DeepSeek 这次给了个现成的抓手:旧模型 ID 会在 10 月 10 日彻底失效,趁现在把调用层收敛到一个别名映射表,以后换底座只动配置:
# llm_router.py —— 把模型选择从业务代码里剥出来
ROUTES = {
"cheap": {"model": "deepseek-flash", # 9-10 起指向 V4.1-Flash
"base": "https://api.deepseek.com"},
"agent": {"model": "glm-5.3-flash", # MIT,1M ctx,Terminal-Bench 84.3
"base": "https://open.bigmodel.cn"},
"omni": {"model": "mimo-v2.6-flash", # 小米全模态,小写 ID
"base": "https://api.xiaomimimo.com"},
"premium": {"model": "claude-fable-5.1", # 复杂推理兜底
"base": "https://api.anthropic.com"},
}
BATCH_TASKS = ("log_triage", "summary", "classify", "draft")
def pick(task: str, budget_per_m: float = 1.0) -> dict:
"""批量任务默认走 cheap 路由,除非任务不在清单或预算极宽。"""
if task in BATCH_TASKS:
return ROUTES["cheap"]
return ROUTES["agent"] if budget_per_m >= 0.5 else ROUTES["cheap"]
价格数字每个月都在变,路由层结构是一次投入长期有效的。等十一月中转商把 MiMo 接进列表,你只需要在 ROUTES 里加一行。
对企业 IT 还有一层:MIT 协议、无营收条款、下载即用,采购流程里“评估开放权重许可”的时间从按周计缩到按天计。上个月你评估一个“开源”模型要读三页定制条款,这个月 DeepSeek 和小米直接把条款简化成两个字母。
具体数字和筛选逻辑,我昨天那篇《这个月开源模型扎堆上新》里刚过完三道筛,这里不重复展开。
※ ※ ※
三、9 月 8 日:NSA、CISA、FBI 三机构联署,“蒸馏”从训练技巧变成安全罪名
9 月 8 日,美国国家安全局、网络安全与基础设施安全局、联邦调查局联合发布了编号 AA26-251A 的网络安全通告,点名 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰、智谱六家中国公司,指控它们自 2024 年底起对美国前沿模型(通告列了 Claude、Gemini、GPT、Grok 的多个版本)实施工业规模知识蒸馏:数百万次交互、数十亿 token 的提取,渠道包括原生 API、云服务、第三方聚合平台和被称为 transfer stations 的代理中转;部分团队批量买高级账号共享,自动切换渠道规避检测。
通告还附带了操作建议:要求美方供应商监控“24 小时持续高通量、缺少人类操作停顿、提示词呈模板化”的异常账户,并对疑似蒸馏流量注入微小扰动、主动降级响应质量。翻译成人话:检测到你在偷师,就故意把答案说错一点。
这三条检测特征值得每个跑批量调用的团队自查一遍,因为它们同时也是封号的常见原因:定时任务在凌晨三点以恒定速率打满并发、提示词模板一字不差地复用上万次、账号在多个渠道间秒级切换,这些行为在平台风控眼里和蒸馏团伙没有区别。我自己维护的夜间批量摘要任务,这个月专门加了三个改动:请求间随机抖动、模板里插入变量字段、跨渠道改串行。十分钟的代码量,买的是一份账号保险。
第二个值得注意的信号藏在“性能降级”这个建议里。一旦你的流量被误判为蒸馏,你拿到的模型输出会被悄悄注水,而你的评测集短期内未必发现。对拿前沿模型输出当训练数据的人来说,这等于数据投毒风险。做合成数据流水线的团队,这个月开始给采回来的数据加一道“来源平台健康度抽检”,已经不是过度谨慎,是基本卫生。
第二天,中国商务部回应“于事无凭、于法无据”,外交部表态愿对话但也警告反制。而时间点很微妙:通告距中美元首华盛顿会晤不到三周,9 月 20 日贝森特与何立峰在纽约会谈时又提出建立 AI 安全“通报机制”。先亮牌再上桌,这套节奏业内都熟。
这件事改变了两类人的默认做法。对在国内用美国前沿模型做蒸馏训练的产品团队,AA26-251A 虽然只是通告不是制裁令,但它给了企业名单、行为描述和检测方法,是后续出口管制或制裁的事实认定底稿——继续这么干的合规风险从灰色变成了明示。对做 API 中转和聚合生意的平台,“防蒸馏”从可选项变成必选项,行为指纹检测这类功能这个月集中上架。
※ ※ ※
四、9 月 10 日:最高法发布首部 AI 裁判规则,AI 幻觉侵权怎么判第一次有了全国性口径
国内这条线,9 月 10 日最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》——国家最高审判机构头一回就 AI 纠纷发布系统性裁判规则文件。四天后的 9 月 14 日,全国网安标委在国家网络安全宣传周开幕式上发布《人工智能安全治理框架 3.0》。两份文件一司法一治理,前后脚落地。
《意见》的内容密度很高,直接点名了四类公众情绪最大的问题:AI 换脸拟声、AI 幻觉侵权、网络开盒、大数据杀熟。几个对从业者最实质的口径:
- ▪ AI 不具有民事主体资格,不能独立作出有法律约束力的意思表示。“是 AI 说的”不构成抗辩。
- ▪ 生成式 AI 侵权适用过错责任:服务提供者尽到“显著提示说明义务、功能可靠性基本保障义务、协议约定的注意义务”,可以认定无过错。全国首例 AI 幻觉侵权案(梁某诉某 AI 公司)就是按这个框架判的。
- ▪ 模型训练使用已公开个人信息是否侵权、AI 生成内容的可专利性、涉开源软件的法律责任,都给出了裁判规则。
- ▪ AI“复活逝者”需死者生前许可,近亲属可对擅自制作死者虚拟形象的行为追责。
注意第二条的举证结构:它没有说“AI 会犯错所以平台无责”,也没有说“AI 犯了错平台全赔”,而是把判断锚定在三件可以留痕的事上:你有没有显著提示、你有没有可靠性保障的动作、你有没有履行自己写进协议的承诺。这三件事全部可以在产品层面工程化:
上线前自查四件套(对应《意见》注意义务清单): □ 生成内容页是否有非弹窗级、不可一键关闭的显著 AI 提示? □ 高风险场景(医疗/法律/金融口径)是否二次提示"不可替代专业意见"? □ 用户协议里承诺的审核/过滤措施,日志里能不能拿出执行证据? □ 训练数据来源清单是否留档?涉已公开个人信息的是否做过必要性评估?
这是对国内所有 AI 产品团队改变默认动作的一件:以前“仅供参考”四个字写在页脚就算免责姿势,现在要看你有没有做“显著提示说明”、有没有留功能可靠性的证据。提示弹窗、免责文本、日志留存,这些原来算产品细节的东西,现在算法律要件。对个人用户同样实用:被换脸视频造谣、被 AI 语音冒充,起诉路径第一次有了全国统一的裁判依据,不用再赌个案。
顺带把治理节奏串一下:2 月网信办等五部门公布《拟人化互动服务管理暂行办法》、7 月 15 日施行,8 月 2 日欧盟 AI 法案透明度义务开始可执法,9 月 10 日最高法《意见》,9 月 14 日安全治理框架 3.0。四个节点连起来看,“AI 合规”在今年从咨询 PPT 变成了有执法动作、有裁判先例的实体领域。做出海产品的注意欧盟那条:2025 年起聊天机器人自报 AI 身份、深度合成内容打标这些义务已经在执行,投诉和举报通道都是活的。
※ ※ ※
没进前四、但同样会写进年表的
九月的前言后序里还有一串事排着队:9 月 3 日 Sanders 和 Casar 提出《禁止人工超级智能法案》,第一次把“封禁 ASI”写进美国正式法案;9 月 8 日前后 Anthropic 研究员 Jacob Coxon 公开辞职指控行业“拿命赌博”;9 月 12 日 Amodei 发《我们必须给前沿设速》,Altman 公开附和;9 月 18 日加州州长纽森签行政令,要求两个月内(11 月 16 日截止)提交前沿模型“杀伤开关”的可验证方案,还把 AI 审计员注册制度的上线时间从 2028 年底直接提前到 2027 年底。放缓派从边缘声音变成了董事会正式议题。这条线不用每天盯,记一个日子就行:十一月中旬,加州专家报告落地那天,看“kill switch”有没有拿到一个可测试的技术定义。没有定义,它就是口号;有了定义,它就是所有前沿实验室的工程合规成本。
四件事,四类人被改写了默认动作:发模型的要多备一个登记处,用模型的先查开源牌价,训模型的把“偷师”从捷径变成风险,做产品的把免责弹窗当法律要件写。九月真正贵的信息不是哪个模型又刷了榜,而是规则本身在换页。
下一篇换个轻松的实操向:我给娃做了个背古诗 App,从 75 首教材诗的判分引擎到飞花令对战的防刷闸门,一个小学生产品的技术选型比想象中刺激。做 AI 应用的朋友,坑我先踩了。
※ ※ ※
※ ※ ※
资料来源
- ▪ CNN、TechCrunch 关于英伟达收购 Hugging Face 的报道(2026-09-03,价格与平台规模数据引自 TechCrunch)
- ▪ Hugging Face deepseek-ai/DeepSeek-V4.1-Flash 仓库与 DeepSeek API 变更日志、定价页(2026-09-10,MIT 协议、552B/196B、1M 上下文、V4-Pro 路由时间表)
- ▪ 小米 MiMo 官方发布页 mimo.mi.com/docs/news/latest/v2-6(2026-09-22 更新);The Next Web、SiliconANGLE 同期报道(AA 智能指数 46、训练成本约 262 万美元)
- ▪ CISA 官网联合网络安全通告 AA26-251A(2026-09-08);中国商务部 9 月 9 日例行回应;联合新闻网报道贝森特-何立峰 AI 通报机制(2026-09-24 见报)
- ▪ 最高人民法院《关于依法审理涉人工智能纠纷案件的意见》新闻发布会(2026-09-10,光明网/最高人民法院知产法庭官网);全国网安标委《人工智能安全治理框架 3.0》(2026-09-14,网信中国)
- ▪ Ban AI Superintelligence Act(2026-09-03,Sanders/Casar 新闻稿);Amodei《We Must Pace the Frontier》(2026-09-12);加州行政令(2026-09-18,州长办公室声明)
- ▪ 以上信息均于 2026-09-24 经多个独立来源交叉查证;数字保留原始报道口径,未做换算。
评论 (0)
登录 或 注册 后参与讨论。