当旗舰模型开始"开源":开放权重如何重写 AI 竞争
8 月 13 日,DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级旗舰模型权重、Meta 预告开放旗舰模型——头部厂商几乎在同一时间窗口押注开源。开放权重从"追赶者的武器"变成"围剿者的战略",正在重写定价逻辑与开发者生态。这是一次技术随笔式的复盘。
收录标记为「开源」的文章。
8 月 13 日,DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级旗舰模型权重、Meta 预告开放旗舰模型——头部厂商几乎在同一时间窗口押注开源。开放权重从"追赶者的武器"变成"围剿者的战略",正在重写定价逻辑与开发者生态。这是一次技术随笔式的复盘。
英伟达 129 亿美元收购 Hugging Face,Stripe 拿下 OpenRouter,算力军备竞赛与智能体安全事件同步升温。八月最后一周,开源生态、算力与安全三条线同时被重新定价。本文是一次技术随笔式的复盘。
8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。
8月14日,智谱官方公众号官宣发布 GLM-5.3。与上一代 GLM-5.2 相比,这次发布的基座模型没有变化,全部提升都来自后训练 Scaling:编程能力在内部体感评测中提升 50%,Terminal-Bench 3.0 取得开源第一,网络安全能力则在 CyberGym 漏洞推理评测中超过 Claude Mythos 5 与 GPT-5.6 Sol。本文梳理 GLM-5.3 的后训练路线、安全能力涌现与开源节奏。
8月13日晚,DeepSeek 在官宣 V4-Pro 正式版全线上线、公布分时调价方案之后,紧接着开源了自研 Agent 运行框架 DeepSeek Harness。模型与执行层同日落地,意味着 DeepSeek 不再只做基础模型与 API,而是向 Claude Code、Codex 所在的 AI 编程执行层正面切入。本文梳理这次双发布的完整时间线、能力变化与行业含义。
8 月 12 日,阿里云按预告开放 Qwen 3.8-Max 权重,2.4 万亿参数、激活 95B,采用 Apache 2.0 许可,同步上线 Hugging Face 与 ModelScope。一周前它在无人干预下连跑 16 天完成开源项目的纪录,如今变成任何人都能下载的权重文件。本文梳理这次开源的技术规格与生态影响,以及它如何改写开源模型的能力天花板。
8 月 10 日,Meta 发布 30B 开源 Agent 模型 Muse Glimmer,Apache 2.0 许可,4-bit 量化后仅约 17GB,单张消费级显卡即可运行本地常驻智能体。扎克伯格同步发出万字长文为"个人超级智能"叙事押注——这一次,开源不再是姿态,而是产品。
MiniMax H3 全模态视频模型开源,DeepSeek V4-Flash 正式公测把单次推理成本压到 3 美分,OpenAI Astra 内部版本用 2000 美元算力破解十项数学难题——同一天,开源与闭源的路线之争迎来新的注脚。
OpenRouter 周调用量榜前五首次全部由中国模型包揽,DeepSeek-V4-Flash 登顶、腾讯混元 3 上榜;阿里发布 2.4 万亿参数 Qwen 3.8-Max,无人干预连跑 16 天完成一个开源项目;微软把 GitHub Copilot 默认模型换成自研 Polaris,彻底切断 OpenAI API——能力、生态、成本三条线同时改写的一周。
OpenAI 的下一代模型 Astra 用约 2000 美元推理成本攻克十项悬而未决至少十年的数学难题;Kimi K3 以 2.8 万亿参数开源重构产业链逻辑;慕尼黑法院裁定 Suno 侵权、欧盟 AI 透明度义务正式生效——能力、成本、规则三条线同时改写的周末。
收录标记为「开源」的文章。
8 月 13 日,DeepSeek V4 Pro 正式版上线、阿里首次开放 Max 级旗舰模型权重、Meta 预告开放旗舰模型——头部厂商几乎在同一时间窗口押注开源。开放权重从"追赶者的武器"变成"围剿者的战略",正在重写定价逻辑与开发者生态。这是一次技术随笔式的复盘。
英伟达 129 亿美元收购 Hugging Face,Stripe 拿下 OpenRouter,算力军备竞赛与智能体安全事件同步升温。八月最后一周,开源生态、算力与安全三条线同时被重新定价。本文是一次技术随笔式的复盘。
8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。
8月14日,智谱官方公众号官宣发布 GLM-5.3。与上一代 GLM-5.2 相比,这次发布的基座模型没有变化,全部提升都来自后训练 Scaling:编程能力在内部体感评测中提升 50%,Terminal-Bench 3.0 取得开源第一,网络安全能力则在 CyberGym 漏洞推理评测中超过 Claude Mythos 5 与 GPT-5.6 Sol。本文梳理 GLM-5.3 的后训练路线、安全能力涌现与开源节奏。
8月13日晚,DeepSeek 在官宣 V4-Pro 正式版全线上线、公布分时调价方案之后,紧接着开源了自研 Agent 运行框架 DeepSeek Harness。模型与执行层同日落地,意味着 DeepSeek 不再只做基础模型与 API,而是向 Claude Code、Codex 所在的 AI 编程执行层正面切入。本文梳理这次双发布的完整时间线、能力变化与行业含义。
8 月 12 日,阿里云按预告开放 Qwen 3.8-Max 权重,2.4 万亿参数、激活 95B,采用 Apache 2.0 许可,同步上线 Hugging Face 与 ModelScope。一周前它在无人干预下连跑 16 天完成开源项目的纪录,如今变成任何人都能下载的权重文件。本文梳理这次开源的技术规格与生态影响,以及它如何改写开源模型的能力天花板。
8 月 10 日,Meta 发布 30B 开源 Agent 模型 Muse Glimmer,Apache 2.0 许可,4-bit 量化后仅约 17GB,单张消费级显卡即可运行本地常驻智能体。扎克伯格同步发出万字长文为"个人超级智能"叙事押注——这一次,开源不再是姿态,而是产品。
MiniMax H3 全模态视频模型开源,DeepSeek V4-Flash 正式公测把单次推理成本压到 3 美分,OpenAI Astra 内部版本用 2000 美元算力破解十项数学难题——同一天,开源与闭源的路线之争迎来新的注脚。
OpenRouter 周调用量榜前五首次全部由中国模型包揽,DeepSeek-V4-Flash 登顶、腾讯混元 3 上榜;阿里发布 2.4 万亿参数 Qwen 3.8-Max,无人干预连跑 16 天完成一个开源项目;微软把 GitHub Copilot 默认模型换成自研 Polaris,彻底切断 OpenAI API——能力、生态、成本三条线同时改写的一周。
OpenAI 的下一代模型 Astra 用约 2000 美元推理成本攻克十项悬而未决至少十年的数学难题;Kimi K3 以 2.8 万亿参数开源重构产业链逻辑;慕尼黑法院裁定 Suno 侵权、欧盟 AI 透明度义务正式生效——能力、成本、规则三条线同时改写的周末。