NVIDIA GPU显卡租赁、购买、维修咨询 13823604209 立即注册
English
资讯中心
Kimi K3 现已上线捷智算,即刻调用
发布时间: 2026-07-30 17:39

2026年7月27日,月之暗面发布Kimi-K3技术报告并同步开放完整模型权重。作为全球参数规模最大的开源基座模型,Kimi K3拥有2.8万亿总参数,每token激活约1040亿参数,原生支持100万token超长上下文。模型发布后迅速登顶WebDev Arena编程榜,成为首个在该榜单超越全部闭源模型的开源模型。

Kimi-K3性能亮点:

编程能力:WebDev Arena Elo评分1678,登顶开源第一;SWE-Marathon GPU内核优化评测得分42.0%,领先Claude Fable 5GPT-5.6 Sol

推理能力:GPQA Diamond得分93.5%,仅落后GPT-5.6 Sol 0.6个百分点

性价比:Kimi Code Bench 2.0得分比Claude Fable 5低约4个百分点,但推理成本仅为后者的38%

核心技术:

Kimi-K3通过序列、深度、宽度三个维度协同创新,整体scaling效率较K2提升约2.5倍:

KDA混合线性注意力:75%注意力层替换为线性注意力,计算复杂度随文本长度线性增长,原生支持100token上下文

AttnRes注意力残差:93层网络每层可直接检索前序所有block输出,突破信息流动瓶颈 

Stable LatentMoE896个路由专家,每token仅激活16个,配合分位数均衡法与SiTU-GLU激活函数,保障训练稳定。
鉴于 Kimi K3 强大的综合性能与开源生态价值,捷智算快速完成平台适配,即日起正式对外开放调用。开发者与企业用户注册即可使用,无需排队等待。

同时,通过捷智算平台进行Kimi-K3的调用,还有以下优势:

1.价格优势:Kimi开放平台官方定价为输入20/百万token、输出100/百万token。捷智算在此基础上额外给予87折优惠,进一步降低模型使用成本。

2.稳定优势:拥有超10000P总算力调度能力,可弹性扩展至50000P,服务于AI算力集群、大模型训练、科学计算等场景,满足大规模并发推理与训练需求。 

3.运维保障:全国多座智算中心,服务10+个人用户及500+中小企业,7×24小时硬件级响应,用户有疑问第一时间解决!
4.灵活优势:支持按小时///月灵活租用,预置高端GPU服务器资源池,快速交付。支持H10050904090A100A800等热门显卡,提供容器、云主机、裸金属三种交付方式。

Kimi K3代表了当前开源模型的最高水准,可广泛服务于多元场景:在研发侧,助力 AI 应用开发与产品集成、大模型研究与学术实验;在产业侧,支撑企业私有化部署评估;在专业服务领域,赋能金融、法律、投研等行业的长文档深度分析,为各类用户提供高效的模型能力支持等等。

稳定高效、性价比高--捷智算持续为用户提供值得信赖的算力基础设施。Kimi K3 的上线是我们持续丰富模型生态的一步,现已就绪,欢迎广大开发者与企业用户访问捷智算平台,即刻体验。


  • 捷智算联系人