代码审查

分布式 Codex 雷达

为AI开发者和独立开发者提供分布式大模型编程能力评测服务

人人蹬一脚,降智无处逃

项目介绍

以下内容来自 codexradar 站长“大模型与小加一”。 https://mp.weixin.qq.com/s/nTzSLrOWgw-zD_EdDtMkDA 过去一个多月,我在 codexradar.com 用自己的订阅定时跑题,给 Codex 画 IQ 曲线。但最近真的测不动了——GPT-5.6 一口气出了 Sol / Terra / Luna 三兄弟,推理档位加起来 18 档,配上 112 道真实开源编程题,一共 2016 个格子。我把自己的订阅烧穿,也只点得亮一个零头。评论区还老有人说:站长,你测的档位跟我用的不一样啊,你一个人测的和你的ip有关吗,你测试的题数量不够啊…行,那就大家一起测。我花了两周时间开发了分布式雷达Codex站。参与很简单:📍 GitHub 登录,在大表里挑格子认领——每格标着价签,大概占你 7 天额度的百分之几,量力认领📍 复制一条命令粘给你的 Codex,它自己配环境、自己跑题、自己上传,你去干别的📍 回来看格子点亮,你的头像上墙,名字上天梯几条我死守的原则:✅ 判分在我服务器的干净环境里重新跑,谁自报的成绩都不算数——包括我自己✅ 你的账号凭据全程留在你自己机器上,我碰不到,也不想碰✅ 烧了额度就给分,过不过都给——愿意啃硬骨头的人不能吃亏✅ 平台故障害你白烧的,照价补积分7 月 15 号开始试运行,第一天冲进来 290 多位志愿者,现在已经 500+ 人、烧了 100 亿+ tokens、1500 多次判分。每月天梯前三名,我自掏腰包做独家定制的 3D 打印雷达奖杯。对了,上一代 GPT-5.5 也被我拉进来同场对照了——到底降没降智,新旧一比,一眼见分晓。诚邀朋友参与一起测试,一起加油把”解题中”维持在200以上,那我们就有一个能够提供准确实时降智指标的理想雷达了

需求相近的,还有这些