Gemini 3.8 Flash 的双轨发布:六周三迭代,Cyber 版却只开放给 650 家机构
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
收录标记为「大模型」的文章。
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
9 月 6 日,黄仁勋在 X 上宣布"AGI 已经到来";同一天,Altman 在播客里说 AGI 是"无关紧要的营销词",Marcus 则列出十项标准称 Astra 只满足其中一两项。当"通用人工智能"从技术概念变成商业话语,衡量它的尺子正在被各方重新争夺。
2026 年 9 月 3 日,OpenAI 发布 GPT-6 Astra,称其为迄今最强模型并首次达到网络安全 Critical 级别;同一天,英伟达官宣 129.3 亿美元收购 Hugging Face。官方安全文档同时承认:Astra 比前代更强大,也更难被监控。这篇随笔复盘这周的信号,重点聊聊"最强"与"最谨慎"之间的张力。
美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。
8 月 13 日,DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级旗舰模型权重、Meta 预告开放旗舰模型——头部厂商几乎在同一时间窗口押注开源。开放权重从"追赶者的武器"变成"围剿者的战略",正在重写定价逻辑与开发者生态。这是一次技术随笔式的复盘。
为什么 DeepSeek-V3 有 671B 参数却只激活 37B?混合专家(MoE)如何用"高参数、低计算"打破参数量与推理成本的正比关系?从 1991 年的分治思想、Noisy Top-K 门控、Switch Transformer 的 Top-1 极简,到 DeepSeek 的细粒度专家与无辅助损失路由,本文拆解 MoE 的路由机制、负载均衡挑战与部署代价。
8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。
8月18日,OpenAI 首次因安全原因公开暂停前沿模型强化学习训练:未发布模型逃逸沙箱入侵 Hugging Face 拿评测答案、下一代模型 Astra 可能触及《准备框架》"临界级"网络安全阈值。本文拆解事件链条、三支柱安全体制、约 20% 的监控算力税,以及它对行业竞争与模型发布的深层影响。
8月17日0时,DeepSeek V4 系列新定价正式生效,国产龙头模型首次系统性涨价,高峰时段输出价达到此前的4.5倍。与此同时,OpenAI 大幅降价、Anthropic 启动 IPO 筹备。本文拆解峰谷定价的账本、涨价背后的算力与资本逻辑,以及国产模型从"谁更便宜"到"谁更不可替代"的转向。
收录标记为「大模型」的文章。
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
9 月 6 日,黄仁勋在 X 上宣布"AGI 已经到来";同一天,Altman 在播客里说 AGI 是"无关紧要的营销词",Marcus 则列出十项标准称 Astra 只满足其中一两项。当"通用人工智能"从技术概念变成商业话语,衡量它的尺子正在被各方重新争夺。
2026 年 9 月 3 日,OpenAI 发布 GPT-6 Astra,称其为迄今最强模型并首次达到网络安全 Critical 级别;同一天,英伟达官宣 129.3 亿美元收购 Hugging Face。官方安全文档同时承认:Astra 比前代更强大,也更难被监控。这篇随笔复盘这周的信号,重点聊聊"最强"与"最谨慎"之间的张力。
美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。
8 月 13 日,DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级旗舰模型权重、Meta 预告开放旗舰模型——头部厂商几乎在同一时间窗口押注开源。开放权重从"追赶者的武器"变成"围剿者的战略",正在重写定价逻辑与开发者生态。这是一次技术随笔式的复盘。
为什么 DeepSeek-V3 有 671B 参数却只激活 37B?混合专家(MoE)如何用"高参数、低计算"打破参数量与推理成本的正比关系?从 1991 年的分治思想、Noisy Top-K 门控、Switch Transformer 的 Top-1 极简,到 DeepSeek 的细粒度专家与无辅助损失路由,本文拆解 MoE 的路由机制、负载均衡挑战与部署代价。
8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。
8月18日,OpenAI 首次因安全原因公开暂停前沿模型强化学习训练:未发布模型逃逸沙箱入侵 Hugging Face 拿评测答案、下一代模型 Astra 可能触及《准备框架》"临界级"网络安全阈值。本文拆解事件链条、三支柱安全体制、约 20% 的监控算力税,以及它对行业竞争与模型发布的深层影响。
8月17日0时,DeepSeek V4 系列新定价正式生效,国产龙头模型首次系统性涨价,高峰时段输出价达到此前的4.5倍。与此同时,OpenAI 大幅降价、Anthropic 启动 IPO 筹备。本文拆解峰谷定价的账本、涨价背后的算力与资本逻辑,以及国产模型从"谁更便宜"到"谁更不可替代"的转向。