KIMI K3 横空出世:2.8T 参数规模强攻大模型王座,一文对比市面主流模型

摘要:本文全面解析月之暗面最新发布的 KIMI K3 大模型。K3 基于 MoE 架构,拥有 2.8 万亿参数与 100 万 token 上下文窗口,是全球首个开源 3 万亿级模型。文章从技术架构、核心提升、主流模型对比、实战应用场景及 API 定价五个维度展开,着重分析其“输入友好、输出偏贵”的定价策略与自部署性价比优势。

关键词:KIMI K3;大模型对比;超长上下文;模型定价;2.8T 参数;开源

1. 引言:KIMI K3 的突然亮剑

在这里插入图片描述

近期,月之暗面低调但有力地发布了新一代大模型 KIMI K3。与上一代 K2 相比,K3 在模型规模、上下文容量以及多任务处理能力上都实现了跨越式提升。业界传闻其总参数规模达到了惊人的 2.8T(2.8 万亿),在 MoE(混合专家)架构下,激活参数却控制得十分优秀,真正做到了“大而快”。与此同时,上下文窗口的极限也再次被拉长,直指超长文档处理与记忆能力的巅峰。

本文将带你看清 KIMI K3 的核心升级,并与当前市面上最具代表性的 Fable 5、GPT 5.5、Opus 4.8、GPT 5.6-Sol 等大模型进行一次横向对比。

2. KIMI K3 技术架构概览与介绍

Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
KIMI K3 之所以能在参数量与上下文两大维度上同时取得突破,核心原因在于其底层架构的彻底革新。与上一代 K2 相比,K3 并非简单的规模堆砌,而是在模型设计、训练策略与部署方案上做了一次系统性升级。

2.1 MoE 架构:大而快的秘密

KIMI K3 延续并大幅扩展了 MoE(混合专家) 架构路线。与传统稠密模型每次推理激活全部参数不同,MoE 将模型拆分为数百个「专家」子网络,每次推理只激活与当前任务最相关的少数几个专家。这使得 K3 虽然在总参数量上达到了惊人的 2.8T,但单次推理的激活参数仅约为数十亿,算力消耗并未等比膨胀,真正实现了「大模型的容量 + 小模型的效率」。

2.2 专家路由机制:让每个任务找到对的大脑分区

K3 的 MoE 架构之上,还有一套精细的动态专家路由网络。当一条 Prompt 进入模型后,路由层会根据输入内容的语义特征,实时判断应该调度哪些专家参与计算。这意味着:

  • 面对数学推理任务时,数学相关的专家被优先激活;
  • 处理代码生成需求时,编程专家主导计算;
  • 解析法律文书学术论文时,相应领域的专家各司其职。

这种“专病专治”的机制,让 K3 在多任务场景下始终保持高水平的泛化能力,避免了过去大模型“什么都会但什么都不精”的通病。

2.3 3 万亿级开源模型

Kimi K3 是首个达到 2.8 万亿参数规模的开源模型。这是 Kimi 持续推进模型规模边界的最新一步:在过去 12 个月(2025/07 – 2026/07)中的 9 个月里,Kimi 模型都保持着开源模型的规模上限。

开源前沿模型规模随时间变化
开源前沿模型规模随时间变化

Kimi K3 基于 Kimi Delta Attention(KDA)和 Attention Residuals(AttnRes)构建。这两项架构更新,都是为了让信息在更长序列和更深模型中流动得更顺畅。
也进一步扩大了 Mixture of Experts(MoE)的稀疏度:结合 Stable LatentMoE 框架后,模型可以在 896 个专家中高效激活 16 个。再加上训练方法和数据配方的优化,这些结构性改进让 Kimi K3 相比 K2 的整体扩展效率提升约 2.5 倍,能更有效地把算力转化为能力。

3. KIMI K3 的核心提升

3.1 参数量:2.8T 的“巨无霸”之身

从 KIMI K2 的数万亿参数开始,月之暗面就已经走上了 MoE 扩规模的道路。KIMI K3 进一步将总参数推至 2.8T,远超当前多数闭源模型的公开数据。但请注意:总参数大并不意味着推理慢。得益于精细的专家路由与动态激活机制,K3 单次推理的激活参数可能仅为数十亿,在保持强大能力的同时兼顾了响应速度。

3.2 上下文容量:跳出 128K,奔向更新的世界纪录

KIMI K2 时期,128K 的长文本处理能力就已经是月之暗面的招牌。K3 进一步将原生上下文窗口提升到了更高的水平,虽然官方尚未给出精确数字,但从内测反馈来看,处理整本《三体》三部曲级别的长文本、持续多轮记忆数千页技术文档已经毫无压力。这意味着在长文档摘要、深度代码库分析、法律文书审查等场景中,K3 可以吃掉更多上下文而不丢逻辑。

3.3 推理与指令跟随:更“懂你”的助手

K3 在指令跟随、多步推理和工具调用方面也做了专项强化。在同等复杂度的 Prompt 下,K3 更少出现“幻觉性跳步”,尤其适合作为 Agent 的大脑,串联外部 API 与知识库。
(约数十 B),单次推理的算力消耗并未等比膨胀。

  • 多任务泛化能力强:不同专家各有所长,模型在面对数学推理、代码生成、法律文书、学术阅读等差异巨大的任务时,都能调度到最合适的「大脑分区」。

4. 市面主流大模型对比一览

下表从参数量、上下文窗口、是否开源、擅长领域和关键特征五个维度,将 KIMI K3 与当前几款标志性模型放在一起对比(部分数据为近似值或公开信息)。

模型参数量(总)上下文窗口开源擅长领域关键特征
KIMI K3~2.8T
(MoE,激活约数十 B)
超长(≥ 128K,内测支持远超)长文档、代码、法律、复杂推理MoE 架构、超大上下文、指令跟随强
Fable 5未公开(推测 ~2T)256K多模态融合、创意生成新一代 Transformer、多模态融合
GPT 5.5未公开128K深度推理、通用对话先进推理链、高并发优化
Opus 4.8未公开(推测 ~1.5T)200K编程、安全对齐、长文本分析先进推理链、代码生成顶级
GPT 5.6-Sol~1.8T128K通用对话、多语言、企业应用高并发优化、生态完善

注:参数量部分基于公开报道和社区推测,实际数据以各厂商官方公告为准。

5. 提升背后的技术看点

5.1 上下文容量为什么重要?

KIMI K3 的上下文能力升级,不只是简单的“能读更长”。它直接决定了模型在 RAG(检索增强生成) 之外的另一种长文本方案:直接全文灌入。对于不希望分割存储、要求模型一次性理解整份知识库的用户,超大上下文是杀手锏。而 2.8T 的总参数规模则为消化这些海量信息提供了足够的“脑容量”。

5.2 与主流模型对比,K3 的差异化在哪?

在这里插入图片描述

  • 对比 Fable 5:Fable 5 强在多模态融合,但在纯文本长上下文处理和中文深度理解上,K3 凭借本土训练数据与超长窗口更具优势。
  • 对比 GPT 5.5:GPT 5.5 擅长深度推理与创意生成,但同样在长上下文和中文场景下,K3 的超长窗口和本土化训练让它在处理海量文档时更从容。
  • 对比 Opus 4.8:Opus 4.8 在代码辅助和安全对齐上体验极佳,但上下文长度仅有 200K,遇到超长文件时可能仍需分段;K3 则试图用「超长窗口」一锤定音。
  • 对比 GPT 5.6-Sol:GPT 5.6-Sol 主打高并发与企业级应用生态,但在密集知识存储和专业领域事实背书上,K3 的 2.8T 总参数量理论上有更强储备。

5.3 2.8T 参数真的是越多越好吗?

大参数量 + MoE 的策略意味着 K3 可以在知识密度上做到极致——相当于把数万本专业书籍的训练知识压缩进了路由网络中。但随之而来的挑战是部署成本与推理延迟。月之暗面能否在 API 服务中维持低廉价格和稳定延迟,是 K3 能否真正流行起来的关键。

6. 实战场景推演:KIMI K3 到底能帮你做什么?

6.1 编码

Kimi K3 具有强大的长视野编码性能。它在极少人工监督下运行,能够持续长时间的工程运行,导航庞大的仓库,并协调终端工具。还擅长将软件工程与视觉推理相结合的任务——它利用截图和视觉素材优化游戏开发、前端和 CAD。

以下案例展示了 Kimi K3 的编码能力如何转化为开放式软件开发和科学研究。

  • 芯片设计:作为早期的概念验证,Kimi K3 设计了一款基于自身架构的纳米模型芯片。在一次 48 小时的自主运行中,K3 利用开源 EDA 工具在 Nangate 45nm 库上构建、优化并验证了芯片。在 4 平方毫米内,芯片闭合时序为 100 MHz,在仿真中可持续超过 8700 个令码/秒的译码吞吐量,包含 146M 标准单元、0.277MB 的 SRAM 和带熔融解码的 INT4 MAC 阵列。由模型构建的芯片,为模型而构建,反映了K3的长视野代理能力。
    在这里插入图片描述

  • GPU 编译器开发:Kimi K3 开发了 MiniTriton,一款紧凑型的 Triton 类编译器,拥有自己的磁片级 IR 层,覆盖 MLIR、优化通道和 PTX 代码生成流水线。在支持的车顶线基准测试中,MiniTriton 的性能与 Triton 和 torch.compile 不相上下甚至更好——在某些工作负载上甚至超过了 Triton。除了微基准测试,MiniTriton 还支持端到端的纳米 GPT 训练,收敛稳定,丢失曲线紧密跟踪参考,仅有轻微偏差——在真实工作负载下验证完整流水线。这些结果表明,Kimi K3 能够构建一个连贯的端到端编译器——从 DSL 前端和 IR 传递到 PTX 代码生成和运行时——而非孤立的内核;其从零开始的张量核心路径已能与 Triton 的高度优化堆栈相媲美。
    在这里插入图片描述

  • 游戏开发与数字创作:Kimi K3 结合了强大的三维推理、编码和视觉能力,将概念、图像和视频转化为完全可玩的互动体验。Kimi K3 通过无缝迭代代码和实时截图实现了真正的“愿景环绕”——即时看到并优化输出。
    在这里插入图片描述
    案例:斗兽场
    Kimi K3 建造了一个互动罗马斗兽场,包含角斗士决斗、动画观众、野生动物和物理驱动的互动。它通过 20+ 轮次迭代自我改进环境和玩法,使用 Chrome 截图检查来检测并修复视觉和游戏性问题。

  • 研究编码:Kimi K3 连接了科学文献与可执行代码,自主实现、验证和分析复杂的计算研究工作流程。
    有一次,Kimi K3 在大约两小时内完成了通常需要一到两周经验研究人员完成的工作。为了在计算天体物理中重现 I–Love–Q 的普遍关系,研究员审阅并交叉验证了 20+ 篇论文,实现了完整的数值流程,评估了 300+ 个状态方程,发现已发表公式中的不一致之处,生成了 3000+ 行 Python 代码,并制作了一个交互式 HTML 仪表盘用于探索结果。
    在这里插入图片描述

6.2 交互式可视化研究

  • 视频剪辑:Kimi K3 在动态设计、动画和视频剪辑方面表现出色,因为它原生的多模态架构能够在同一模型中理解文本、图像和视频。

例如,K3 创建了一个类似 3Blue1Brown 风格的动态图形解释器,介绍其架构,将技术理念转化为动画图表和过渡。
在这里插入图片描述

  • 知识工作:K3 推动了端到端知识工作的进步。除了公开基准测试外,Kimi K3(max)在内部评估中持续取得优异,这些评估源自现实世界用户代理工作流程中反复出现的模式和挑战。这些跨不同生产导向工作流程的持续优势反映了Kimi K3 智能知识工作能力的广泛提升。
    在这里插入图片描述
  • 互动网站

案例一:互动式 42 年人工智能 ASIC 行业研究网站
一份你可以深入挖掘的互动研究报告:ASIC 行业 42 年历史,经过120+轮递归自我提升而诞生。Kimi K3 将证据转化为定制图表、动画图表和互动视觉叙事。它通过2.8k+ 网页搜索/取用和1.1k+终端数据拉取数据,涵盖11k+页,涵盖87份季度报告和99份原始PDF。
在这里插入图片描述
案例二:GWTC-5 引力波分析
利用20+并发子剂分析391个引力波事件,产生7个科学可视化、2个表格和10+论文的文献综合。
在这里插入图片描述

7. 大模型定价对比:KIMI K3 性价比几何?

除了模型能力,API 调用价格也是开发者和企业选型时的关键考量。KIMI K3 在提供 2.8T 总参数与 1,048,576 tokens(约 100 万 token)上下文窗口 的前提下,定价相比上一代 K2 有一定上浮,整体处于旗舰模型中的中等偏上水平。下表整理了 KIMI K3 与主流旗舰模型的 API 官方定价(按每百万 token 计,人民币):

模型输入价格(¥/百万 tokens)输出价格(¥/百万 tokens)上下文窗口备注
KIMI K3缓存命中 ¥2.0 / 未命中 ¥20.0¥100.01,048,576 tokens开源可自部署,输出价格较高
Fable 5¥25.0¥100.0256K旗舰闭源,多模态性能领先
GPT 5.5¥14.0¥56.0128K深度推理、创意生成
Opus 4.8¥28.0¥126.0200K高端推理,编程特化
GPT 5.6-Sol¥14.0¥56.0128K平衡性能与成本,生态完善

注:以上价格基于各厂商 2026 年 7 月公开 API 定价(美元按 1:7 折算为人民币),实际价格可能因调用量、区域等因素有所浮动,请以各平台最新公告为准。KIMI K3 的输入价格区分缓存命中/未命中两种场景。

7.1 KIMI K3 定价策略解读

从上表可以看出,KIMI K3 的 API 定价呈现出 “输入友好、输出偏贵” 的明显分化:

  • 输入侧优势显著:缓存命中时输入仅 ¥2.0/百万 token,这意味着在重复使用相同系统提示、长文档前缀等场景下,输入成本远低于 GPT 5.5 和 Opus 4.8 等竞品。即使缓存未命中时的 ¥20.0/百万 token,也低于 Fable 5 的 ¥25.0 和 Opus 4.8 的 ¥28.0;
  • 输出侧价格偏高:输出 ¥100.0/百万 token,与 Fable 5 持平,是 GPT 5.5/GPT 5.6-Sol 的近两倍,甚至超过 Opus 4.8 的 ¥126.0 的约 80% 水平——考虑到 Opus 在编程上的顶级口碑,K3 的输出定价显得尤其昂贵;
  • 整体性价比评估:K3 适合 “读多写少” 的场景——例如全仓库代码审查、整本法律文书分析、大规模文档检索等任务中,大量输入 token 配合极少输出 token,总成本可控;但在 “写多读少” 的生成式场景(如长文创作、代码大规模生成)下,输出价格高企会让综合费用快速攀升,性价比明显不及 GPT 5.5 和 GPT 5.6-Sol。

在这里插入图片描述

7.2 开源红利:自部署才是真正的性价比杀招

KIMI K3 作为首个 3 万亿级别开源模型,其 API 定价虽然偏贵,但自部署路径彻底改变了成本结构。对于拥有 H100/A100 等 GPU 集群的企业用户:

  • 长上下文场景的极致节省:API 模式下,1,048,576 tokens 的上下文窗口意味着每次调用都可能传输海量 token,输出成本累积极快;而自部署只需承担硬件折旧与电力成本,边际成本趋近于零;
  • 高并发场景的灵活调度:企业可根据自有负载弹性扩缩推理实例,无需为闲置时间付费;
  • 数据安全与定制自由:自部署兼顾合规与微调需求,在金融、医疗、政务等对数据出域敏感的行业中尤为关键。

总体而言,KIMI K3 的 API 定价并非低到无脑入手的程度——输出侧的 ¥100.0/百万 tokens 需要开发者在场景选择上更审慎。但对于有能力自部署的团队,K3 仍是目前开源生态中参数规模最大、上下文最长的旗舰选项,一旦跑通自建推理服务,其综合成本优势是任何闭源 API 都无法企及的。

8. 调用实战示例

下面通过两个典型场景,演示如何通过 Python 调用 KIMI K3 官方 API 完成长文本摘要与代码生成,并提供环境配置、错误处理以及成本估算的完整示例。

8.1 环境准备

  • Python 3.8 及以上版本,或 Node.js 18 及以上版本。
  • OpenAI SDK 1.0.0 及以上版本。Kimi API 兼容 OpenAI API 格式,你可以直接使用 Python 或 Node.js OpenAI SDK 进行调用。
pip install --upgrade 'openai>=1.0' # Python
npm install openai@latest # Node.js

8.2 开始使用

  • 获取 API Key:从 Kimi 开放平台中创建一个 API 密钥,将其传入以便平台正确识别你的身份。OpenAI Client
export MOONSHOT_API_KEY="你的_KIMI_API_KEY"

在这里插入图片描述

  • 选择模型:作为快速开始入口,建议优先从 Kimi K3 开始;也可以根据场景选择 Kimi K2.7 Code 或 Kimi K2.6。
    在这里插入图片描述
  • 选择调用方式:Kimi API 兼容 OpenAI API 格式,你可以根据项目技术栈选择最合适的接入方式。
    在这里插入图片描述
  • 第一次调用:下面以 Kimi K3 模型为例。示例中的需要替换为你在平台上创建的 API Key,或提前设置为同名环境变量。MOONSHOT_API_KEY
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["MOONSHOT_API_KEY"],
    base_url="https://api.moonshot.cn/v1",
)

completion = client.chat.completions.create(
    model="kimi-k3",
    messages=[
        {"role": "system", "content": "你是 Kimi,由 Moonshot AI 提供的人工智能助手,你更擅长中文和英文的对话。你会为用户提供安全,有帮助,准确的回答。同时,你会拒绝一切涉及恐怖主义,种族歧视,黄色暴力等问题的回答。Moonshot AI 为专有名词,不可翻译成其他语言。"},
        {"role": "user", "content": "你好,我叫李雷,1+1等于多少?"}
    ]
)

print(completion.choices[0].message.content)

如果成功运行上述代码,且没有任何报错,你将看到类似如下的内容输出:

你好,李雷!1+1 等于 2。这是一个基本的数学加法问题。如果你有其他问题或需要帮助,请随时告诉我。

8.2 长文本摘要示例

利用 K3 的超长上下文能力,可以将整本书或长篇报告直接喂给模型进行摘要。以下示例演示如何调用 API 并计算每次调用的预估成本。

import os
from openai import OpenAI

# 配置客户端(建议通过环境变量管理 API Key)
client = OpenAI(
    api_key=os.environ.get("KIMI_API_KEY", "your-kimi-api-key"),
    base_url="https://api.moonshot.cn/v1",
)

def summarize_long_text(text: str) -> str:
    """
    使用 KIMI K3 对超长文本进行摘要
    成本估算注释:
      - 输入价格(缓存未命中):¥20.0 / 百万 tokens
      - 输出价格:¥100.0 / 百万 tokens
      - 示例:输入 ~50,000 tokens,输出 ~500 tokens
        成本 ≈ (50,000*20 + 500*100) / 1,000,000 = 1.05 元
    """
    try:
        response = client.chat.completions.create(
            model="kimi-k3",               # 具体模型名以官方为准
            messages=[
                {"role": "system", "content": "你是一个专业文档摘要助手,请生成结构化的中文摘要。"},
                {"role": "user", "content": f"请对以下长文档进行摘要:\n\n{text}"}
            ],
            temperature=0.3,
            max_tokens=500,                 # 限制输出长度以控制成本
        )
        summary = response.choices[0].message.content
        # 获取实际用量
        usage = response.usage
        prompt_tokens = usage.prompt_tokens
        completion_tokens = usage.completion_tokens
        # 计算成本(假设缓存未命中)
        cost = (prompt_tokens * 20 + completion_tokens * 100) / 1_000_000
        print(f"[用量] 输入: {prompt_tokens} tokens, 输出: {completion_tokens} tokens")
        print(f"[成本] 预估 ¥{cost:.4f}")
        return summary
    except Exception as e:
        print(f"[错误] API 调用失败: {e}")
        # 可在此实现重试、降级或告警逻辑
        return ""

# 测试(使用一段模拟长文本)
if __name__ == "__main__":
    long_article = (
        "人工智能的发展历程可以追溯到20 世纪 50 年代,经过了多次浪潮..."
        * 500  # 构造一个约 10 万字的超长文档
    )
    result = summarize_long_text(long_article)
    print("--- 摘要结果 ---")
    print(result)

8.3 代码生成示例

KIMI K3 在编程任务上也表现出色。下面的例子展示如何使用 K3 根据需求生成 Python 函数,并包含错误处理与成本估算。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ.get("KIMI_API_KEY", "your-kimi-api-key"),
    base_url="https://api.moonshot.cn/v1",
)

def generate_code(task_description: str) -> str:
    """
    使用 KIMI K3 生成代码
    成本估算注释:
      - 输入 prompt 约 150 tokens
      - 输出代码约 600 tokens
      - 成本 ≈ (150 * 20 + 600 * 100) / 1,000,000 = 0.063 元
    """
    try:
        response = client.chat.completions.create(
            model="kimi-k3",
            messages=[
                {"role": "system", "content": "你是一个资深 Python 工程师,请写出可运行、带注释的代码。"},
                {"role": "user", "content": task_description}
            ],
            temperature=0.2,
            max_tokens=800,
        )
        code = response.choices[0].message.content
        usage = response.usage
        prompt_tokens = usage.prompt_tokens
        completion_tokens = usage.completion_tokens
        cost = (prompt_tokens * 20 + completion_tokens * 100) / 1_000_000
        print(f"[用量] 输入: {prompt_tokens} tokens, 输出: {completion_tokens} tokens")
        print(f"[成本] 预估 ¥{cost:.4f}")
        return code
    except Exception as e:
        print(f"[错误] API 调用失败: {e}")
        return ""

# 测试
if __name__ == "__main__":
    task = "请用 Python 编写一个函数,使用 rapidfuzz 库计算两个字符串的相似度,并以百分比形式返回。"
    generated_code = generate_code(task)
    print("--- 生成代码 ---")
    print(generated_code)

9. 结语

KIMI K3 的发布,再次将大模型军备竞赛推向了新的高度:2.8T 参数规模、100 万 token 上下文窗口、首个 3 万亿级开源模型——这三个标签叠加在一起,足以让它成为 2026 年大模型领域绕不开的里程碑。

回顾全文,我们可以清晰地看到 K3 的战略定位:

  • 架构层面:MoE + 896 专家 + 动态路由,让「参数量大」与「推理快」不再矛盾,相比 K2 整体扩展效率提升约 2.5 倍;
  • 能力层面:超长上下文直击 RAG 之外的另一种范式——全文灌入式理解,在长文档摘要、全仓库代码审查、法律文书分析等场景中建立起天然壁垒;
  • 定价层面:「输入友好、输出偏贵」的梯度定价,精准筛选了「读多写少」的高价值场景;而开源自部署路径,则为有硬件能力的团队打开了成本几乎归零的想象空间;
  • 生态层面:从芯片设计到 GPU 编译器开发,从引力波分析到互动网站生成,K3 在实战中的表现已经超越了传统「语言模型」的边界,更像一个长程自主代理(Long-Horizon Agent) 的雏形。

当然,K3 并非无懈可击。输出侧 ¥100.0/百万 token 的定价对于「写多读少」的生成式场景仍是一道门槛;自部署对硬件的高要求(H100/A100 集群起步)也让中小团队望而却步;而开源社区能否围绕 K3 快速构建起类似 Llama 生态的工具链和微调资源,同样需要时间验证。

对开发者的建议

  • 如果你经常处理超长文档分析、全仓库级代码审查、法律合同审阅等「输入密集、输出精简」的任务,K3 的 API 是当前性价比最高的选择之一;
  • 如果你的团队拥有 GPU 集群且对数据安全、定制微调有强需求,自部署 K3 的综合成本优势是任何闭源模型都无法比拟的;
  • 如果你的场景以高频短回复对话、轻量级文本生成为主,GPT 5.5 或 GPT 5.6-Sol 的均衡定价可能更适合日常运营。

展望未来,KIMI K3 的意义或许不止于一款模型——它证明了开源路线同样能造出万亿级别的旗舰,也推动了「长上下文」从锦上添花的特性变为核心竞争维度。当 GPT 下一代、Fable、Opus 等跟进者纷纷拉长窗口、扩大参数量时,整个行业的「上下文壁垒」将被重新定义。

正如 K3 用 48 小时自主设计了一枚芯片、用两小时完成一周的研究工作所展示的那样——我们正在进入一个模型不再只是「回答问题」,而是能够长期自主执行复杂任务的新时代。与其把 K3 看作一把「更锋利的刀」,不如把它视为一个信号:大模型的竞争,正从「谁更会说话」转向「谁更会干活」

而这一次,月之暗面率先亮出了答卷。剩下的,就看整个行业如何接招了。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值