Gemini 3.8 Flash 的双轨发布:六周三迭代,Cyber 版却只开放给 650 家机构
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
收录标记为「Agent」的文章。
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
2026 年 9 月 2 日发布的 VS Code 1.136 将重点放在 Agent 工作流上:Agent Merge 进入公开预览,负责处理评审意见、失败检查和合并冲突直至 PR 可合并;会话层级管理、跨窗口 Agent host 与多根工作区支持同步到来。本文基于官方 Release Notes 梳理这些变化。
美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。
8月13日晚,DeepSeek 在官宣 V4-Pro 正式版全线上线、公布分时调价方案之后,紧接着开源了自研 Agent 运行框架 DeepSeek Harness。模型与执行层同日落地,意味着 DeepSeek 不再只做基础模型与 API,而是向 Claude Code、Codex 所在的 AI 编程执行层正面切入。本文梳理这次双发布的完整时间线、能力变化与行业含义。
8 月 10 日,Meta 发布 30B 开源 Agent 模型 Muse Glimmer,Apache 2.0 许可,4-bit 量化后仅约 17GB,单张消费级显卡即可运行本地常驻智能体。扎克伯格同步发出万字长文为"个人超级智能"叙事押注——这一次,开源不再是姿态,而是产品。
8 月第一周,OpenAI Astra、DeepSeek-V4-Flash、阿里 Qwen3.8-Max 密集落地,中国头部模型集体跨过 2 万亿参数门槛。参数规模之外,Qwen3.8-Max 用 16 天无人值守完成开源项目、Astra 攻克十项数学难题——大模型竞赛的核心正在从"单次回答的正确率"转向"长周期端到端交付能力"。
八月第一天,OpenAI 在白宫演示多智能体协作的 Astra,DeepSeek 用纯后训练把 Agent 能力推上新高,中国开源模型下载份额登顶——模型正从「单打独斗」走向「组团干活」。
七月最后一天,DeepSeek V3.2 打通思考与工具调用,Thinking Machines 用四分之一体量反超万亿大哥,国产算力规模翻三倍——模型正从「想得好」跨入「做得到」。
WorkBuddy登陆鸿蒙、AI手机集体转向Agent模式、全球数字经济大会提出"主体革命"——智能体正从"会回答问题"走向"能完成任务",而这场变革的速度远超预期。
收录标记为「Agent」的文章。
9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。
2026 年 9 月 2 日发布的 VS Code 1.136 将重点放在 Agent 工作流上:Agent Merge 进入公开预览,负责处理评审意见、失败检查和合并冲突直至 PR 可合并;会话层级管理、跨窗口 Agent host 与多根工作区支持同步到来。本文基于官方 Release Notes 梳理这些变化。
美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。
8月13日晚,DeepSeek 在官宣 V4-Pro 正式版全线上线、公布分时调价方案之后,紧接着开源了自研 Agent 运行框架 DeepSeek Harness。模型与执行层同日落地,意味着 DeepSeek 不再只做基础模型与 API,而是向 Claude Code、Codex 所在的 AI 编程执行层正面切入。本文梳理这次双发布的完整时间线、能力变化与行业含义。
8 月 10 日,Meta 发布 30B 开源 Agent 模型 Muse Glimmer,Apache 2.0 许可,4-bit 量化后仅约 17GB,单张消费级显卡即可运行本地常驻智能体。扎克伯格同步发出万字长文为"个人超级智能"叙事押注——这一次,开源不再是姿态,而是产品。
8 月第一周,OpenAI Astra、DeepSeek-V4-Flash、阿里 Qwen3.8-Max 密集落地,中国头部模型集体跨过 2 万亿参数门槛。参数规模之外,Qwen3.8-Max 用 16 天无人值守完成开源项目、Astra 攻克十项数学难题——大模型竞赛的核心正在从"单次回答的正确率"转向"长周期端到端交付能力"。
八月第一天,OpenAI 在白宫演示多智能体协作的 Astra,DeepSeek 用纯后训练把 Agent 能力推上新高,中国开源模型下载份额登顶——模型正从「单打独斗」走向「组团干活」。
七月最后一天,DeepSeek V3.2 打通思考与工具调用,Thinking Machines 用四分之一体量反超万亿大哥,国产算力规模翻三倍——模型正从「想得好」跨入「做得到」。
WorkBuddy登陆鸿蒙、AI手机集体转向Agent模式、全球数字经济大会提出"主体革命"——智能体正从"会回答问题"走向"能完成任务",而这场变革的速度远超预期。