正文内容 评论(0

编程用哪个AI大模型好?实测Qwen3.8和Kimi K3
2026-07-27 16:33:23  作者:世玉 编辑:世玉     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

7月,国产大模型杀疯了。Kimi K3刚扔出2.8T参数的王炸,阿里转头就宣布2.4T的Qwen3.8“仅次于Fable 5”。口号喊得震天响,却连个Benchmark数据都舍不得放?不信邪,我花了三天把它们按在地上摩擦了一遍。结果,有惊喜,更多的是惊吓。

一、一张表看懂谁强谁弱

对比项 Qwen3.8 (阿里) Kimi K3 (月之暗面)
一句话评价 编程特长生,Agent任务惊艳 全能优等生,前端开发封神
基础编码 强,一次过LRU和全栈项目 极强,综合能力更稳
Agent自主任务

最大亮点

:自主分析仓库、找3个真实Bug并修复

强,但未重点展示
3D创意编程

×

严重翻车

:只能做静态场景,动效交互全崩
√ 表现强劲,甚至优于GPT-5.6
中文写作 意外惊喜,没有AI套话味 好,但中规中矩
价格友好度 ⭐⭐⭐(39元/月起) ⭐(20元/100元 每百万Token)
适合谁 预算有限的开发者、需要代码助手 预算充足、追求顶尖综合能力的专业用户

二、写代码,Qwen3.8确实硬气了一把基础算法和全栈项目它都轻松拿下,但最让我吃惊的是Agent任务。扔给它一个GitHub仓库链接,让它自己分析结构、找Bug、提方案,最后克隆下来修复。它真的一口气跑通了,找出的三个Bug全是真实存在的。在这个价位上,它的自主执行能力,目前没对手。

三、但一搞创意,立马翻车然而,轮到3D浮岛创意题,Qwen3.8就原形毕露了。岛浮起来了,树和草也有了,然后……就没有然后了。说好的滚动驱动相机叙事?相机纹丝不动。物件交互?点击悬停全没反应。所有涉及动效和交互的代码逻辑全线崩溃。这跟参数大小无关,纯粹是后训练审美和用户体验的功课落下了。

四、中文写作,意外成了“偏科生”的救赎神奇的是,让它写一篇分析AI发布潮的长文,居然有模有样。结构清晰,论点扎实,最关键的是没有那该死的“AI套话味”

五、“仅次于Fable 5”?这话得拆开看在纯编码赛道,它确实配得上“第二”。但论全面能力,尤其是创意编程、多模态理解,跟顶流的差距不止十个百分点。更让人不舒服的是发布方式——没数据、没报告、没模型卡,只靠一条推文立Flag,连激活参数量都藏着掖着。

六、我的结论:别吹,但值得等Qwen3.8是个典型的“偏科天才”,在代码和Agent领域性价比极高。但现在的它还不完整。

值得一提的是,就在Qwen3.8发布的同一天(7月21日),阿里的Qwen-Image-3.0-Pro图像生成模型也正式上线了,而且已经集成到了pixpix平台,这款模型主打复杂版面生成、10像素小字精准渲染、12国语言支持,文生图评测中仅次于GPT Image 2,是国内排名第一的图像模型-4。pixpix(www.pixpix.com)上可以直接使用这款国内最强的图像生成模型,用于产品图、详情页、多语言物料等商业场景

编程用哪个AI大模型好?实测Qwen3.8和Kimi K3

【本文结束】如需转载请务必注明出处:快科技

责任编辑:世玉

文章内容举报

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |
本文收录在
#快讯

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...