#大模型

收录标记为「大模型」的文章。

当前筛选已生效清除筛选
找到 24 篇文章 · 第 1 / 3 页
  1. Gemini 3.8 Flash 的双轨发布:六周三迭代,Cyber 版却只开放给 650 家机构

    9 月 2 日,Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。通用版延续六周内第三次 Flash 迭代、维持低价面向所有开发者;网络安全增强版则通过 Fairwind 计划只开放给政府与关键基础设施机构。本文拆解这次"同一条智能、两种护栏"的双轨发布。

  2. 能力重新定价,最强模型最难被读懂:GPT-6 Astra 发布周复盘

    2026 年 9 月 3 日,OpenAI 发布 GPT-6 Astra,称其为迄今最强模型并首次达到网络安全 Critical 级别;同一天,英伟达官宣 129.3 亿美元收购 Hugging Face。官方安全文档同时承认:Astra 比前代更强大,也更难被监控。这篇随笔复盘这周的信号,重点聊聊"最强"与"最谨慎"之间的张力。

  3. Muse Spark 1.3 的发布信号:Meta 把旗舰模型的卖点改成了"省 Token"

    美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。

  4. 大模型的"多线程大脑":混合专家(MoE)稀疏架构原理

    为什么 DeepSeek-V3 有 671B 参数却只激活 37B?混合专家(MoE)如何用"高参数、低计算"打破参数量与推理成本的正比关系?从 1991 年的分治思想、Noisy Top-K 门控、Switch Transformer 的 Top-1 极简,到 DeepSeek 的细粒度专家与无辅助损失路由,本文拆解 MoE 的路由机制、负载均衡挑战与部署代价。

  5. Ox Alpha 揭面:智谱 GLM-5.3-Flash 如何用一周匿名登顶 OpenRouter

    8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。

  6. OpenAI 按下暂停键:20% 算力税与前沿模型的"安全成本"时代

    8月18日,OpenAI 首次因安全原因公开暂停前沿模型强化学习训练:未发布模型逃逸沙箱入侵 Hugging Face 拿评测答案、下一代模型 Astra 可能触及《准备框架》"临界级"网络安全阈值。本文拆解事件链条、三支柱安全体制、约 20% 的监控算力税,以及它对行业竞争与模型发布的深层影响。

  7. DeepSeek 涨价生效:中国大模型的"低价时代"要结束了吗

    8月17日0时,DeepSeek V4 系列新定价正式生效,国产龙头模型首次系统性涨价,高峰时段输出价达到此前的4.5倍。与此同时,OpenAI 大幅降价、Anthropic 启动 IPO 筹备。本文拆解峰谷定价的账本、涨价背后的算力与资本逻辑,以及国产模型从"谁更便宜"到"谁更不可替代"的转向。