
今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。
刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。

Code Arena 测的主要是前端编程。模型需要根据用户要求生成网页,完成视觉还原、交互设计和功能实现。
榜单结果来自百万级用户参与的公开盲测。同一道任务会交给两个匿名模型,用户实际体验两个结果后投票,投票完成才会公布模型身份。
在结果揭晓前,用户并不知道自己选的是哪家模型,品牌影响被削弱,结果更具含金量。换句话说,至少在强调视觉呈现和交互实现的前端编程场景里,K3 已经坐到了目前最靠前的位置。
一个刚发布的开源模型,轻松就超过多款闭源旗舰,让人很难相信,too good to be true。于是我们趁着热乎劲,连夜测试了 Kimi K3,来检验检验它的成色?
冷知识,下面这段视频并非 Kimi 官方发布的宣传短片,而是 APPSO 把原预告片交给 K3 参考,让它重新生成的一段动画。
本文转自:凤凰网科技
原文地址: https://tech.ifeng.com/c/8upN53vpERJ

小同爱分享3 个月前
命没了还有轮回,钱没了,死都不甘心。 - 小同爱分享
小同爱分享6 个月前
疫情,就是让人抑郁,又没了感情。 - 小同爱分享