Kimi新模型火爆,真实能力如何?

現在の言語の翻訳がありません。原文を表示しています。
Kimi发布K3模型,采用MoE架构,提升编程与多模态任务能力。

7月17日,Kimi新模型K3发布了,市场火爆,就连智谱与MINIMAX的股票都跌了

这一次,Kimi没有选择小幅升级,而是直接进入“大模型军备竞赛”的核心战场

本次K3核心亮点拉满,总参数高达2.8万亿,采用行业顶尖的MoE混合专家架构

简单科普:参数就是AI的知识与逻辑储备单元,参数体量越大,智能上限越高

而MoE架构就像拥有896位各领域专精的专家团队,模型不会每次全员待命,只会根据用户需求,精准激活16位对应专家运算

那关于Kimi K3的真实能力测评到底怎么样呢?

编程能力

早年大模型仅能生成零散代码片段,而真实软件开发需要搞定架构、渲染、交互、调试全链路,门槛极高

Kimi K3 工程级开发能力大幅跃升,多项实测对标甚至超越部分闭源模型

实测落地案例十分具体:上传一段 3D 棱镜宣传视频,它能自主解析动态光影、几何体结构,一键输出完整可运行的 WebGL 渲染工程

独立编写底层 Shader 实现色散光带特效;一句话生成带经营、碰撞、天气系统的 3D 开放世界

甚至自主复刻全功能网页版 MacOS、从零搭建 GPU 编译器、产出完整可玩 3D 射击游戏 Demo

不同于传统 AI 一次性输出代码,K3 支持视觉迭代闭环:生成代码后自动运行、截图自查问题、反复修改优化;依托百万 Token 长上下文,可通读上万行项目源码,独立完成跨模块开发、Bug 修复

Agent能力

传统 AI 只能被动回答单条问题,无法自主串联多步骤复杂工作

而 Kimi K3 的 Agent 能力实现质变,具备目标拆解、工具调用、自主执行、自查自纠的完整工程闭环

它可以全自动完成整套竞品逆向开发流程

输入指令 “分析并复刻某款主流可视化后台系统”,Kimi 会自动打开浏览器遍历全站功能、拆解页面路由、分析交互逻辑、识别技术栈,一次性输出完整竞品调研报告

除此之外,它还能独立完成全流程项目开发任务:

不同于传统 AI “一问一答” 的碎片化输出,Kimi K3 可以连续几十步自主作业、自动调用工具、自我纠错迭代

多模态能力

过往大模型只能依托文字指令开展工作,但研发、设计场景里大量核心信息都藏在 UI 稿、效果图、产品动画、实拍视频中

Kimi K3 大幅强化视频与图像解析能力,多模态实测表现优于不少海外闭源模型

落地场景清晰直观:上传一段产品动态宣传短片,它能逐帧拆解页面分层布局、关键动画时序、3D 模型几何结构、光影渲染参数,完整梳理整套视觉实现逻辑,直接输出可落地的前端开发方案

导入多张分层设计稿,可自动识别组件规范、交互跳转逻辑,批量生成配套页面代码

能够直接读懂现实世界的视觉素材,成为 AI Agent 落地的核心底层能力

共有先:

著者:Think AI

本記事はPANews入駐コラムニストの見解であり、PANewsの立場を代表するものではなく、法的責任を負いません。

記事及び見解は投資助言を構成しません

画像出典:Think AI。権利侵害がある場合は著者へ削除をご連絡ください。

PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
PANews APP
外電:トランプ氏、早ければ今週中にも数十カ国に新たな関税を課す見通し
PANews 速報