domestic-llm - 超腾开源标签

2026年初,国产AI编程大模型(如GLM-4.5、MiniMax M2.5、Kimi K2.5)在编程能力上已接近国际顶尖模型Claude Opus 4.5,而价格仅为后者的十分之一左右。文章基于SWE-Bench Verified榜单评估了各模型的编程性能,并详细对比了智谱AI、MiniMax、月之暗面、火山引擎、摩尔线程、百度、阿里云、腾讯云等厂商的编程套餐价格、调用限额和可用模型。通过性价比分析,作者建议排除使用受限的Kimi套餐及不支持主流高性能模型(如GLM-5、MiniMax-M2.5)的选项,最终推荐智谱AI、MiniMax、百度智能云、阿里云和腾讯云的套餐,为开发者提供了选择参考。
1560
2026-02-13
本文通过一个复杂的外卖配送调度优化项目,实测了2025年底发布的六款国产大模型(Kimi-K2-0905、DeepSeek-V3.1-Terminus、Doubao-Seed-Code、DeepSeek-V3.2、GLM-4.7、MiniMax-M2.1)的AI编程能力。测试在Trae和CodeBuddy IDE两种环境下进行,使用统一的提示词要求构建包含地图、随机位置生成、路径优化算法及动画演示的完整应用。 测试结果表明,AI编程能力主要取决于大模型本身。GLM-4.7表现最为出色,生成的程序界面美观、动画流畅;MiniMax M2.1和DeepSeek-V3.1-Terminus次之,基本能实现核心功能;DeepSeek-V3.2和Doubao-Seed-Code存在部分缺陷;而Kimi-K2-0905则无法完成有效开发。文章总结认为,国产大模型在复杂编程任务上已具备替代国际顶级模型的潜力,并推荐开发者尝试相关工具进行验证。
1300
2025-12-29