资讯首页
302.AI官网
专题分类
基准实验室
新品发布
深度拆解
赛博月刊
实战教程
更新日志
302.AI入门指南
下载客户端
API文档
AI 大模型评测、教程、深度分析 | 302.AI Blog
首页
302.AI 基准实验室 | 模型测评
第3页
302.AI 基准实验室 | 模型测评
基准实验室
30天限免开启,Step 3.7 Flash实测:不惊艳但顺手,Agent不用省着用了丨302.AI 基准实验室
2026 年 6 月 5 日
2.0K
0
1
基准实验室
MiniMax M3 实测:4大场景对决 GPT-5.5,开源大模型 Agent 能力全面解析 | 302.AI
2026 年 6 月 3 日
3.8K
0
0
基准实验室
Claude Opus 4.8 实测:69.2% SWE-Bench 登顶,0%谎报率,4大场景全面解析 | 302.AI
2026 年 6 月 1 日
1.4K
0
0
基准实验室
Qwen3.7-Max 实测:5大场景对决 Claude Opus,阿里旗舰模型全面解析 | 302.AI
2026 年 5 月 26 日
3.0K
0
0
基准实验室
Gemini 3.5 Flash 实测:289 Token/s 速度碾压,4大场景对决 GPT-5.5 | 302.AI
2026 年 5 月 21 日
3.4K
0
0
基准实验室
Grok 4.3 实测:放弃“最强模型”叙事,从聊天机器人到数字员工的务实转身丨302.AI 基准实验室
2026 年 5 月 13 日
2.3K
0
1
基准实验室
GPT-5.5 实测:牺牲了惊艳,换来了不出错,这笔翻倍溢价值不值得掏?丨302.AI 基准实验室
2026 年 5 月 8 日
2.0K
0
0
基准实验室
开源最强还是工程最强?Kimi K2.6 实测:长程执行与 Agent 能力的分水岭丨302.AI 基准实验室
2026 年 5 月 6 日
2.7K
0
0
基准实验室
能力跻身第一梯队?DeepSeek-V4-Pro 实测:从参数竞赛回归场景适配丨302.AI 基准实验室
2026 年 4 月 27 日
5.0K
0
0
基准实验室
GPT Image 2 实测:Arena.AI 1512分霸榜,8大场景验证 AI 绘图新标杆 | 302.AI
2026 年 4 月 23 日
6.9K
0
1
3 / 22
1
2
3
4
5
6