302.AI

  • Kimi K2.7 Code 实测:告别过度思考,Token 消耗锐减 30%丨302.AI

    文章导读: 月之暗面开源 Kimi K2.7 Code,首次将编码能力独立优化。新版本成功摆脱 K2.6 的“过度思考”顽疾,多模态表现亮眼,编程跑分涨了一截,价格却只有顶尖闭源模型的五分之一。实测下来,它离 Claude Opus 4.8 还有距离,但在性价比这条赛道上,它的确更适配个人开发者和中小团队。 6 月 12 日,月之暗面正式发布并开源了 Kim…

    2026 年 6 月 22 日 基准实验室
    2.7K0
  • GLM-5.2 实测:4大场景对决 Claude Opus 4.8,国产大模型最强编程能力 | 302.AI

    文章导读: 在 Anthropic 关停顶尖模型之际,智谱逆势宣布 GLM-5.2 全量开放并采用 MIT 协议开源。这款拥有 1M 真实上下文、代码能力全球第三的国产模型,实力究竟如何?本文通过逻辑、编程及多场景实测,将其与 Claude Opus 4.8 进行对比测评。结果显示,GLM-5.2 在逻辑推理上表现出色,虽在工程落地细节上稍逊一筹,但已无疑是…

    2026 年 6 月 17 日 基准实验室
    5.9K0
  • Claude Fable 5 实测:80.3% SWE-Bench 登顶,当前最强公开模型全面解析 | 302.AI

    文章导读: Anthropic 发布“神话级”模型 Claude Fable 5。作为当前最强公开模型,它到底有多能打?实测显示:Fable 5 的绝对统治区在于长周期、高复杂度的工程交付,编码性能远在 Opus 系列之上,展现出断层领先的 Agent 级实力;但最强亦有代价,翻倍的定价,以及用户吐槽度极高的“静默降级”风险,花高价换来的“非完整版”究竟值不…

    2026 年 6 月 12 日 基准实验室
    3.8K0
  • 302.AI CLI Skill 实测:开发者命令行 AIGC 工具箱,调用全模型 | 302.AI

    文章导读: 对于开发者来说,最影响效率的往往不是写代码,而是在各种 AI 工具之间来回切换,生成所需素材并手动集成到项目中。302.AI 推出的 CLI Skill 旨在解决这一问题。它将图片、视频、音频、3D 等生成能力统一接入终端和 IDE,让开发者无需离开当前工作环境,就能完成从素材生成到项目部署的完整流程。本文将通过实战教程,展示这套多模态工作流如何…

    2026 年 6 月 10 日 实战教程
    9630
  • Claude Code 前端设计神器,Taste Skill实测: 把 AI 设计从能看变成能商用 | 302.AI

    文章导读: 2026 年 AI Skills 生态爆发,狂揽 37k Stars 的开源项目 Taste Skill 以亮眼表现突出重围。高端的审美品味真能被代码量化吗?本文通过深度实测,使用三大案例:法拉利商业落地页搭建、存量项目 UI 重构、全套品牌资产创建,带你全面拆解这款的前端审美神器,看它如何用数值化参数打破 AI 界面的平庸套路,真正实现商用级交…

    2026 年 6 月 8 日 实战教程
    2.0K0
  • 30天限免开启,Step 3.7 Flash实测:不惊艳但顺手,Agent不用省着用了丨302.AI 基准实验室

    文章导读: “Flash”往往被视作大模型的轻量妥协版,但阶跃星辰最新发布的 1980 亿参数 MoE 模型 Step-3.7-Flash,却试图打破这一刻板印象。凭借最高 400 Tokens/s 的极速输出、原生多模态与 Agent 能力,它究竟是只停留在纸面参数,还是真有两把刷子?综合实测显示:模型或许未达顶级 Pro 的智商上限,却在速度、稳定性与性…

    2026 年 6 月 5 日 基准实验室
    3.4K0
  • MiniMax M3 实测:4大场景对决 GPT-5.5,开源大模型 Agent 能力全面解析 | 302.AI

    文章导读: MiniMax 重磅发布新一代旗舰模型 M3,一举成为全球首个同时具备 Frontier 三件套——前沿 Coding 与 Agent 能力、1M 超长上下文、原生多模态的开源权重模型。作为开源阵营中罕见的“全能选手”,其真实表现如何?实测表明:M3 的代码生成与长程 Agent 能力是最大亮点,多模态补齐版图,高性价比依旧是杀手锏,但与顶尖闭源…

    2026 年 6 月 3 日 基准实验室
    4.2K0
  • Claude Opus 4.8 实测:69.2% SWE-Bench 登顶,0%谎报率,4大场景全面解析 | 302.AI

    文章导读: 距 4.7 发布仅 40 天,Claude Opus 4.8 极速登场,或为 Anthropic 面对激烈竞争的一场防守反击?当竞争对手在高性价比赛道疯狂攻城略地,Opus 4.8 依然不卷性价比,而是主打“诚实度”。从系统级编程的工程执行力跃升,到谎报率降至 0% 的突破,再到能调度上百个子智能体并行作业的 Agent 能力,新版本正向企业核心…

    2026 年 6 月 1 日 基准实验室
    2.6K0
  • Huashu Design Skill 实测:15K Star 开源设计神器,7大设计能力全面解析 | 302.AI

    文章导读: AI 时代做 PPT,只能在“高颜值难修改”和“易排版但廉价”中二选一吗?开源神器 Huashu Design Skill 的横空出世或许打破了这一僵局。作为 GitHub 斩获 15k+ Star 的“全能开源 Claude Design”,它既能生成 Stripe 级的高保真 HTML 演示稿,又能导出可修改的 PPTX 文件。本文将通过实测…

    2026 年 5 月 28 日 实战教程
    2.3K0
  • Qwen3.7-Max 实测:5大场景对决 Claude Opus,阿里旗舰模型全面解析 | 302.AI

    文章导读: 距离上代发布仅一月,阿里全新旗舰模型 Qwen3.7-Max 正式上线,剑指全能智能体基座。测评发现,相比 Qwen3.6-Plus,新版本模型在逻辑推理上更具动态构造性,视觉审美与代码交互表现力更是大幅进化,尤其在长周期自主任务中展现出较强稳定性。本文将通过多维度实战案例,探索这位“Max 级数字员工”的真实生产力。 5月20日,距离上一次模型…

    2026 年 5 月 26 日 基准实验室
    3.2K0