ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

大语言模型综合排行榜 26-02-01图片本周排名前10的模型为:Gemini 3 ProGPT-5.2Gemini 3 FlashClaude Opus 4.5GPT

大语言模型综合排行榜 26-02-01图片本周排名前10的模型为:Gemini 3 ProGPT-5.2Gemini 3 FlashClaude Opus 4.5GPT

大语言模型综合排行榜 26-02-01

原创 网球玩的人 老网的博客2026年2月1日 16:25加拿大

本周排名前10的模型为:

Gemini 3 Pro

GPT-5.2

Gemini 3 Flash

Claude Opus 4.5

GPT-5.1

Kimi-K2.5

GPT-5

DeepSeek v3.2

GLM-4.7

GPT-5.1 Mini

简介:

本表格汇总了常用大语言模型在主流评测排行榜上的表现。评测范围涵盖:

人类偏好(文字和视觉),知识与推理,数学能力,代码能力,长文本推理,和指令遵循能力。

在整合各项评测结果的基础上,计算出综合排名。

更新:

本次排名,Kimi-K2.5模型首次加入榜单。它没有特别出彩的表现,但综合实力均衡,且比Kimi-K2有明显提升,跻身第六。

artifical analysis边的数据更新了Qwen 3 max的推理模型的结果。比起非推理模型,整体能力大幅提升。

除了gpt-4.5,本榜单所有模型皆为推理模型。推理能力基本上是顶尖模型的标配了。

总结:

综合实力最强:Gemini 3 Pro

国内最强模型:Kimi-K2.5/DeepSeek v3.2/GLM-4.7

最强开源模型:Kimi-K2.5/DeepSeek v3.2/GLM-4.7

最强代码模型:Gemini 3 Pro/GPT-5.2/Claude Opus 4.5

本项目仓库:

https://github.com/Tennisatw/LLM-Leaderboard

返回列表