综合 LMSYS Arena、LiveBench、Artificial Analysis、SWE-bench、HLE、MMLU-Pro、GPQA 七大权威评测,涵盖 Claude、GPT、Gemini、DeepSeek 等全球主流模型
综合所有主流基准测试的加权排名,全面衡量模型综合实力
Unexpected token '<', "<!DOCTYPE "... is not valid JSON
数据来源