# AI 代码能力雷达 AI 代码能力雷达 (https://codex.rtt.icu) 是一个客观、实时的综合数据看板,专门用于监控、评测各大主流大语言模型(如 GPT-5.5、Claude Opus 4.7、DeepSeek V4 Pro、Gemini 3.5 Flash 等)的编程能力与环境稳定性。 ## 核心页面 - 首页(综合看板): https://codex.rtt.icu/ - AI 代码能力排行榜: https://codex.rtt.icu/leaderboard - 模型对决对比: https://codex.rtt.icu/compare - 订阅状态诊断: https://codex.rtt.icu/status - 关于与评测原理: https://codex.rtt.icu/about - 排行榜历史回放: https://codex.rtt.icu/leaderboard/replay ## 热门模型对比 - GPT-5.5 vs Claude Opus 4.7: https://codex.rtt.icu/compare/gpt-5-5-vs-claude-opus-4-7 - GPT-5.5 vs DeepSeek V4 Pro: https://codex.rtt.icu/compare/gpt-5-5-vs-deepseek-v4-pro - Claude Opus 4.7 vs DeepSeek V4 Pro: https://codex.rtt.icu/compare/claude-opus-4-7-vs-deepseek-v4-pro - GPT-5.5 vs Gemini 3.5 Flash: https://codex.rtt.icu/compare/gpt-5-5-vs-gemini-3-5-flash - GPT-5.5 vs GPT-5.4: https://codex.rtt.icu/compare/gpt-5-5-vs-gpt-5-4 - Claude Opus 4.7 vs Claude Sonnet 4.6: https://codex.rtt.icu/compare/claude-opus-4-7-vs-claude-sonnet-4-6 ## 核心功能 1. **AI 代码能力排行榜**: 依据高难度沙盒任务(例如并发 I/O、复杂数据流处理)的成功率及代码规范度进行动态 Arena 评分排行。 2. **状态诊断与降智预警**: 实时监测闭源 API(如 Codex)的健康状况,预测用量限制重置周期以及额度过载导致的代码逻辑退化概率。 3. **模型参数横向对比**: 详细罗列各模型的加分项(如预读覆盖率 B1、并发熔断 B2)与异常扣分项(如文件锁死 H13、死循环 H16),帮助开发者做出最合适的 API 选择。 ## 面向对象 适合需要调用大模型 API 辅助进行深度软件开发、自动化工程测试的开发者。我们提供准确的历史走势与前瞻性降智雷达预警,确保开发者能在模型推理 IQ 最高的窗口期提交高负载任务。 ## 机器可读索引 - Sitemap: https://codex.rtt.icu/sitemap.xml - Robots: https://codex.rtt.icu/robots.txt - LLMs Index: https://codex.rtt.icu/llms.txt