大模型
- 多模态三条路:Gemini 看图看视频,ChatGPT 抢语音,Claude 吃长文档
2026 年 8 月,多模态已经不是「能不能看图」的是非题,…
- 编程智能体评测改写:Terminal-Bench 比「会写函数」更能拉开差距
2026 年的编码评测已经从「补全一行代码」转到「在真实终端…
- Meta 带着 Muse Code 杀进编程智能体,价格战从模型打到工具链
2026 年夏天,编程智能体不再只是「把 Claude…
- Grok 4.6 更新:xAI 继续卷「编码性价比」和实时信息
xAI 的 Grok 4.6 被描述为在既有超大基础模型上的…
- 开源权重并不「落后一代」:Kimi K3 与 DeepSeek V4 主打每美元智力
闭源旗舰把跑分打到只差一两个点之后,开源权重模型的叙事换成…
- Gemini 3.1 Pro:长上下文和研究生级推理仍是谷歌的牌面
Google DeepMind 的 Gemini 3.1…
- Claude Opus 5 登顶独立智力指数,Fable 5 仍咬得很紧
8 月上旬更新的 Artificial Analysis…
- GPT-5.6 分档落地:Sol、Terra、Luna 把性价比重新切开
OpenAI 在 2026 年中把 GPT-5.6…
