AI中转站Bench测试

投稿

不检测渠道接口规范, 只检测渠道任务能力, 通过多种渠道统计渠道差异

数据更新于
无任何中转赞助、广告从用户角度出发体验自费评测、监控可用率
模型晴雨表近 24h 中转健康度
Claude+5.9%
98.2%
GPT+0.5%
97.4%
模型愚蠢指数30D愚蠢指数, 越高越好
Claude+2.5
69.561–76
GPT-3.0
74.563–80

筛选条件

厂商
支持渠道

测试次数1,383

测试题目16

总计花费$774.61

正在加载 Bench 数据...