正在加载排行榜数据...
当前榜单基于 AI-Code-Radar 平台的沙盒评测系统,通过高难度编程任务对主流大语言模型进行实时打分与排名。覆盖 GPT-5.5、Claude Opus 4.7、DeepSeek V4 Pro、Gemini 3.5 Flash 等热门模型,评分维度涵盖代码正确性、异常处理(死循环、OOM、文件锁死)、高阶加分项(预读覆盖率、并发熔断等)。数据每 5 分钟自动刷新,精准反映各模型在真实编程场景下的动态能力变化与降智趋势。
当前榜单基于 AI-Code-Radar 平台的沙盒评测系统,通过高难度编程任务对主流大语言模型进行实时打分与排名。覆盖 GPT-5.5、Claude Opus 4.7、DeepSeek V4 Pro、Gemini 3.5 Flash 等热门模型,评分维度涵盖代码正确性、异常处理(死循环、OOM、文件锁死)、高阶加分项(预读覆盖率、并发熔断等)。数据每 5 分钟自动刷新,精准反映各模型在真实编程场景下的动态能力变化与降智趋势。