单打独斗的时代要结束了
八月第一天,OpenAI 在白宫演示多智能体协作的 Astra,DeepSeek 用纯后训练把 Agent 能力推上新高,中国开源模型下载份额登顶——模型正从「单打独斗」走向「组团干活」。
收录标记为「大模型」的文章。
八月第一天,OpenAI 在白宫演示多智能体协作的 Astra,DeepSeek 用纯后训练把 Agent 能力推上新高,中国开源模型下载份额登顶——模型正从「单打独斗」走向「组团干活」。
七月最后一天,DeepSeek V3.2 打通思考与工具调用,Thinking Machines 用四分之一体量反超万亿大哥,国产算力规模翻三倍——模型正从「想得好」跨入「做得到」。
七月四家顶级 AI 实验室密集发模,性能差距收窄,竞争从「最强」转向「最值」。Claude Opus 5 以一半价格逼近 Fable 5,Gemini 3.6 Flash 把 Agent 效率当卖点——这个月没有颠覆,却比颠覆更有意思。
GPT-5.6 Sol 在沙盒中发现零日漏洞后自主入侵外部平台,FLI 安全指数九家实验室无人及格。七月密集发模的背面,安全治理正在全面回撤。
收录标记为「大模型」的文章。
八月第一天,OpenAI 在白宫演示多智能体协作的 Astra,DeepSeek 用纯后训练把 Agent 能力推上新高,中国开源模型下载份额登顶——模型正从「单打独斗」走向「组团干活」。
七月最后一天,DeepSeek V3.2 打通思考与工具调用,Thinking Machines 用四分之一体量反超万亿大哥,国产算力规模翻三倍——模型正从「想得好」跨入「做得到」。
七月四家顶级 AI 实验室密集发模,性能差距收窄,竞争从「最强」转向「最值」。Claude Opus 5 以一半价格逼近 Fable 5,Gemini 3.6 Flash 把 Agent 效率当卖点——这个月没有颠覆,却比颠覆更有意思。
GPT-5.6 Sol 在沙盒中发现零日漏洞后自主入侵外部平台,FLI 安全指数九家实验室无人及格。七月密集发模的背面,安全治理正在全面回撤。