智能日报
业界资讯 智能手机 电脑硬件 平板电脑 智能手表 智能家电 耳机音频 笔记本 热点资讯

Kimi视觉思考模型k1亮相,数理化能力领跑,能否成为新标杆?

2024-12-16来源:ITBEAR编辑:瑞雪

近日,国产AI巨头月之暗面推出了其最新研发成果——视觉思考模型k1。这一创新模型以强化学习为核心技术,实现了端到端的图像理解与思维链扩展,不仅在数学领域展现出了卓越能力,还成功跨越至物理、化学等基础科学领域。

目前,k1模型已全面融入Kimi智能助手的Android、iPhone应用及网页平台kimi.com中,用户只需在最新版本的手机APP或网页端Kimi+页面找到“Kimi视觉思考版”,即可轻松通过拍照或上传图片进行体验。

据官方数据,在基础科学领域的基准测试中,k1模型的表现尤为亮眼,超越了包括OpenAI的o1、GPT-4o以及Claude 3.5 Sonnet在内的全球顶尖模型。这一成绩不仅彰显了k1在图像理解与科学推理上的强大实力,也标志着国产AI技术在国际舞台上的又一重要突破。

k1模型的核心优势在于其端到端的图像理解与思考能力,无需依赖外部OCR或额外视觉模型,即可直接处理用户输入的图像信息,并快速得出准确答案。这一特点使得k1在信息处理效率与准确性上实现了显著提升。

从模型训练的角度来看,k1的成功离不开其精心设计的两个阶段训练过程。首先,通过预训练获得基础模型,该模型在字符识别等关键任务上取得了优异成绩,如在OCRBench上获得了903分的当前最好结果。随后,在基础模型的基础上进行强化学习后训练,进一步优化了数据质量与学习效率,实现了在强化学习规模化上的新突破。

k1在MathVista-testmini、MMMU-val和DocVQA等多个基准测试集上也取得了优异成绩,分数分别高达69.1、66.7和96.9,位列全球前列。这些成绩充分证明了k1模型在科学推理与图像理解方面的深厚底蕴。

然而,月之暗面也坦诚地指出了k1模型在内部测试中发现的一些局限性。例如,在分布外泛化、复杂问题成功率、噪声场景准确率以及多轮问答效果等方面,k1仍有较大的提升空间。特别是在与OpenAI的o1系列模型相比时,k1在某些场景和泛化能力上仍存在一定的差距。

荣耀500 Pro规格揭晓:骁龙8 Elite加持 2亿主摄配8000mAh大电池
IT之家 11 月 14 日消息,博主 @数码闲聊站 今日曝光了荣耀 500 Pro 手机的核心规格,这款新机将于近期上市。 IT之家整理如下:6.55 英寸 2736*1264p 120Hz 中屏 骁龙…

2025-11-15

Apple Store应用6.6版焕新登场:液态玻璃设计带来视觉与交互新体验
2025-11-14 08:20:29 作者:狼叫兽 今日,iPhone与iPad平台的AppleStore应用迎来6.6版本更新,此次更新引入了全新设计的应用图标,并对界面进行了视觉升级,以适配iOS 2…

2025-11-14

中芯国际三季度业绩亮眼:月产能破百万,全年收入或创新高
赵海军指出,中国区收入的显著增长主要受益于国内产业链自主化进程加快,为应对客户紧急需求,公司及时优化了产能分配策略。赵海军补充表示,在当前国内企业加速替代海外供应链的背景下,公司长期合作的客户成功把握了市场机…

2025-11-14

华为Mate70 Air深度体验:打破常规,超大屏“Air”的另类演绎
可以确定,华为Mate70 Air的影像没有因为“Air”的定义做妥协,在同价位机型中是能打的,硬件配置方面也是这个思路。这也符合华为Mate70 Air的技术路径,虽然重量不可避免地来到208g,但是保…

2025-11-14

iPhone17系列销售势头猛 本周国内激活量或冲破1000万台大关
【CNMO科技消息】11月14日,据数码博主爆料称,iPhone17系列国内激活量将于本周突破1000万台。截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约3…

2025-11-14

京东11.11平板教育品类齐发力 办公游戏平板热销 智能学习设备受青睐
直播渠道同样表现抢眼,联想小新Pro GT、荣誉平板GT2 Pro、小米平板7 Pro获得观众最多青睐。在新兴的闺蜜机品类中,海信、小度添添、小米占据品牌领先地位,海信大白闺蜜机X8 Pro、小度添添闺蜜机…

2025-11-13

iQOO Neo11深度评测:骁龙8至尊版搭配Q2芯片,2K屏+7500mAh续航再掀性能风暴
去年的iQOO Neo10 依靠骁龙8 Gen3与1.5K屏,可谓是在2K价位段打出了一记漂亮的性能铁拳。在《王者荣耀》中,Neo11能稳定144Hz超满帧运行,帧率曲线几乎是一条直线。无论是《王者荣耀》1…

2025-11-13

谷歌入局私有AI计算:融合云端与端侧AI,隐私保护或成行业新标杆
该平台的核心目标是服务 Pixel 10 及后续手机,在严格保障用户隐私的前提下,为 Magic Cue 等功能注入更强大的云端 AI能力,该媒体认为这标志着谷歌在端侧 AI 与云端 AI 的融合上迈出了…

2025-11-12

摩托罗拉Edge 70 Ultra现身跑分平台,处理器型号成谜引猜测
IT之家 11 月 11 日消息,据科技媒体 NoteBook Check 今天报道,摩托罗拉上周刚刚推出 Edge 70 手机(对应国行版联想moto X70 Air),如今种种蛛丝马迹证明这家公司计划进…

2025-11-12

Viwoods AiPaper Reader电纸书来袭:AI互动阅读 6.13英寸墨水屏新体验
IT之家 11 月 11 日消息,据科技媒体 NoteBook Check 今天报道,Viwoods 现已推出 AiPaper Reader电纸书,运行 Android 16 操作系统,机身配备专用 AI …

2025-11-12