0814前沿模型综合评价

我们从多维度评价了目前的前沿模型。 参与模型: Claude Fable5、GPT-5.6Sol、Kimi-k3、GLM-5.2、DeepSeek-V4-Pro-0813。 评价维度: 1. 模型能力有多强; 2. 完成真实任务到底有多贵; 3. 为完成任务消耗多少 token; 4. Prompt Cache 能在多大程度上进一步降低成本。

阅读完整文档