Kimi全新思考模型“月之暗面 Kimi K2 Thinking”发布_中房网_中国房地产业协会官方网站_欧洲杯足球网

Kimi全新思考模型“月之暗面 Kimi K2 Thinking”发布

AI快讯苏晓 2025-11-12 14:52:34 来源：中房网

??中房网讯 据“月之暗面Kimi”官微11月6日消息，月之暗面宣布发布Kimi K2 Thinking开源思考模型，并称其为“Kimi 迄今能力最强的开源思考模型”。

??据悉，该模型基于「模型即 Agent」理念训练的新一代 Thinking Agent，它原生掌握「边思考，边使用工具」的能力。在人类最后的考试（Humanity's Last Exam）、自主网络浏览能力（BrowseComp）、复杂信息收集推理（SEAL-0）等多项基准测试中表现达到 SOTA 水平。

??Kimi K2 Thinking 模型无需人类干预，即可凭借持续稳定的深度思考能力自主实现高达 300 步的工具调用，从而帮助用户解决更复杂的问题。

??月之暗面Kimi指出，该模型推理性能全面提升。Kimi K2 Thinking 模型在人类最后的考试（Humanity's Last Exam）中展现出强大的推理与问题解决能力。人类最后的考试是一项涵盖 100 多个专业领域的终极封闭式学术测试。在允许使用工具——搜索、Python、网络浏览工具的同等情况下，Kimi K2 Thinking 在这项基准评测中取得了 44.9% 的 SOTA 成绩。

??自主搜索与浏览能力全面提升。在复杂搜索和浏览场景中，Kimi K2 Thinking 模型也表现出色。BrowseComp 是由 OpenAI 发布的一个专门评估 AI Agent 网络浏览能力的基准测试，这项测试的初衷是衡量 AI Agent 在信息过载环境中展现出的坚持性与创造力，即能否像人类研究员一样「刨根问底」。在这项极具挑战的任务上，人类平均只能达到 29.2% 的成绩。Kimi K2 Thinking 在这项基准测试中展现出极强的钻研能力，以 60.2% 的成绩成为新的 SOTA 模型。

??Agentic 编程能力持续精进。Kimi K2 Thinking 模型的编码能力也得到了增强，在多语言软件工程基准 SWE-Multilingual、SWE-bench 验证集和 Terminal 终端使用等基准测试中的表现有了进一步提升。Kimi K2 Thinking 在处理 HTML、React 以及组件丰富的前端任务时性能有明显提升，能将创意转变为功能齐全、响应式的产品。在 Agentic Coding 场景中，Kimi K2 Thinking 能在调用各种工具的同时进行思考，灵活地融入 software agents 中，处理更复杂、多步骤的开发工作流。

??此外，通用基础能力升级。Kimi K2 Thinking 显著提升了写作能力，它能将粗略的灵感转化为清晰、动人且意图明确的叙述，使其兼具韵律感和深度。它能轻松驾驭微妙的文风差异和模糊的结构，并在长篇大论中保持风格的连贯性。在创意写作方面，它笔下的意象更生动，情感共鸣更强烈，将精准的表达与丰富的表现力融为一体。在学术研究和专业领域，Kimi K2 Thinking 在分析深度、信息准确性和逻辑结构方面均有显著提升。它能有条不紊地剖析复杂的指令，并以清晰严谨的方式拓展思路。这使其尤其擅长处理学术论文、技术摘要，以及那些对信息完整性和推理质量要求极高的长篇报告。在回应个人或情感类问题时，Kimi K2 Thinking 的回答更富同理心，立场也更中正平和。它的思考深入周到且具体明确，能提供细致入微的观点和切实可行的后续建议。它能清晰并关切地帮助用户梳理复杂的决策，其语气既脚踏实地又切实中肯，更有人情味。

??目前，Kimi K2 Thinking 模型已上线 kimi.com 和最新版 Kimi 手机应用的常规对话模式。Kimi Agent 模式的底层模型后续也将升级为 Kimi K2 Thinking 模型，带来完整的多步思考和工具调用能力。

Kimi

2025-11-12 更多

中国城市住房价格288指数

(2023-02)

1571.9点

0.13%
-0.91%

日期	指数	环比	同比
2023.01	1569.9	-0.97%	-0.14%
2022.12	1572.1	-0.92%	-0.11%
2022.11	1573.9	-0.12%	-1.08%
2022.10	1575.8	-0.20%	-1.01%
2022.09	1579.0	-0.02%	-0.87%
2022.08	1579.3	-0.04%	-0.62%

欧洲杯足球网_欧洲杯开户app￥外围平台

中国城市住房价格288指数