Kimi新模型火爆,真实能力如何?

Kimi K3 发布,三大能力全面跃升

  • 编程能力:工程级开发,可自主生成完整 WebGL 项目、3D 开放世界,甚至复刻 macOS 网页版,并支持视觉闭环自我迭代。
  • Agent 能力:具备任务拆解、工具调用、自主执行与纠错能力,能全自动完成竞品分析、全流程项目开发,连续数十步无需人工干预。
  • 多模态能力:强化视频与图像解析,可逐帧分析宣传片、自动识别设计稿组件,直接输出可落地的前端代码,打通视觉素材到开发的壁垒。

Kimi K3 总参数达 2.8 万亿,采用 MoE 架构,精准激活专家运算,多项实测对标甚至超越闭源模型,引发市场强烈反响。

总结

7月17日,Kimi新模型K3发布了,市场火爆,就连智谱与MINIMAX的股票都跌了

这一次,Kimi没有选择小幅升级,而是直接进入“大模型军备竞赛”的核心战场

本次K3核心亮点拉满,总参数高达2.8万亿,采用行业顶尖的MoE混合专家架构

简单科普:参数就是AI的知识与逻辑储备单元,参数体量越大,智能上限越高

而MoE架构就像拥有896位各领域专精的专家团队,模型不会每次全员待命,只会根据用户需求,精准激活16位对应专家运算

那关于Kimi K3的真实能力测评到底怎么样呢?

编程能力

早年大模型仅能生成零散代码片段,而真实软件开发需要搞定架构、渲染、交互、调试全链路,门槛极高

Kimi K3 工程级开发能力大幅跃升,多项实测对标甚至超越部分闭源模型

实测落地案例十分具体:上传一段 3D 棱镜宣传视频,它能自主解析动态光影、几何体结构,一键输出完整可运行的 WebGL 渲染工程

独立编写底层 Shader 实现色散光带特效;一句话生成带经营、碰撞、天气系统的 3D 开放世界

甚至自主复刻全功能网页版 MacOS、从零搭建 GPU 编译器、产出完整可玩 3D 射击游戏 Demo

不同于传统 AI 一次性输出代码,K3 支持视觉迭代闭环:生成代码后自动运行、截图自查问题、反复修改优化;依托百万 Token 长上下文,可通读上万行项目源码,独立完成跨模块开发、Bug 修复

Agent能力

传统 AI 只能被动回答单条问题,无法自主串联多步骤复杂工作

而 Kimi K3 的 Agent 能力实现质变,具备目标拆解、工具调用、自主执行、自查自纠的完整工程闭环

它可以全自动完成整套竞品逆向开发流程

输入指令 “分析并复刻某款主流可视化后台系统”,Kimi 会自动打开浏览器遍历全站功能、拆解页面路由、分析交互逻辑、识别技术栈,一次性输出完整竞品调研报告

除此之外,它还能独立完成全流程项目开发任务:

不同于传统 AI “一问一答” 的碎片化输出,Kimi K3 可以连续几十步自主作业、自动调用工具、自我纠错迭代

多模态能力

过往大模型只能依托文字指令开展工作,但研发、设计场景里大量核心信息都藏在 UI 稿、效果图、产品动画、实拍视频中

Kimi K3 大幅强化视频与图像解析能力,多模态实测表现优于不少海外闭源模型

落地场景清晰直观:上传一段产品动态宣传短片,它能逐帧拆解页面分层布局、关键动画时序、3D 模型几何结构、光影渲染参数,完整梳理整套视觉实现逻辑,直接输出可落地的前端开发方案

导入多张分层设计稿,可自动识别组件规范、交互跳转逻辑,批量生成配套页面代码

能够直接读懂现实世界的视觉素材,成为 AI Agent 落地的核心底层能力

分享至:

作者:Think AI

本文为PANews入驻专栏作者的观点,不代表PANews立场,不承担法律责任。

文章及观点也不构成投资意见

图片来源:Think AI如有侵权,请联系作者删除。

关注PANews官方账号,一起穿越牛熊
PANews APP
加密板块普遍反弹,DeFi板块涨超2%,仅SocialFi板块下跌
PANews 快讯