#AIGC

收录标记为「AIGC」的文章。

当前筛选已生效清除筛选
找到 59 篇文章 · 第 2 / 6 页
  1. Muse Spark 1.3 的发布信号:Meta 把旗舰模型的卖点改成了"省 Token"

    美东时间 9 月 2 日,Meta 发布迄今最强模型 Muse Spark 1.3。官方对比口径是编程能力优于 GPT-5.6 Sol、与 Claude Fable 5.1 持平;但更值得注意的升级方向是工具调用减少约 20%、相同任务 Token 消耗减少 25%,以及对长周期智能体任务的专项优化。当旗舰模型的竞争开始比拼"单位任务的成本",Meta 选择了一条和对手不同的路。

  2. 大模型的"多线程大脑":混合专家(MoE)稀疏架构原理

    为什么 DeepSeek-V3 有 671B 参数却只激活 37B?混合专家(MoE)如何用"高参数、低计算"打破参数量与推理成本的正比关系?从 1991 年的分治思想、Noisy Top-K 门控、Switch Transformer 的 Top-1 极简,到 DeepSeek 的细粒度专家与无辅助损失路由,本文拆解 MoE 的路由机制、负载均衡挑战与部署代价。

  3. Ox Alpha 揭面:智谱 GLM-5.3-Flash 如何用一周匿名登顶 OpenRouter

    8月20日,一个代号 Ox Alpha 的匿名模型悄然上线 OpenRouter,一周内处理约 23.2 万亿 token 登顶使用量榜首,社区戏称它"牛来";8月26日晚智谱揭晓谜底——这是 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash(320B-A18B),并当晚开源权重。本文还原这场"模型侦探战",拆解混合注意力架构、1/10 定价与全栈国产芯片的算力故事。

  4. 英伟达的"AI 工厂"棋局:从卖铲人到全栈玩家

    8月24日 Hot Chips 2026 上,英伟达一口气官宣三件事:面向智能体推理的 Groq 3 LPX 全面量产、Vera Rubin NVL72 在真实智能体负载下每兆瓦吞吐量最高提升 30 倍、SpaceXAI 将 Vera Rubin 平台延伸至轨道计算。叠加此前一周披露的 70 亿美元 Poolside 交易与正在谈判的 Perplexity 投资,英伟达正在从"卖 GPU 的铲子商人"变成同时经营硬件、网络、开源权重模型与生态投资的全栈玩家。本文拆解这些动作及其背后的行业信号。

  5. GitHub Copilot 走进 Slack 与 Teams:编码代理开始"在团队会话里上班"

    8 月 21 日,GitHub Copilot 在 Slack 与 Microsoft Teams 的集成同日进入公开预览:在频道、群聊或私聊里 @GitHub,就能把一个云代理会话拉进对话,让它调查问题、改代码、开 PR,整个团队都能看见并引导。配合前一天的 Slack Code 频道与 Codex CLI 的 agents dashboard,本周的信号很清楚——编码代理正在从"个人终端里的工具"变成"团队协作的一部分"。本文拆解这三件事及其背后的取向。