尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
是 Kable 不是 Fable,Kimi 向全世界证明了四件事
作为全球首个开源 3 万亿级大模型总参数 2.8 万亿这个数字足够震撼。从 K2 的万亿参数到今天的 K3中国开源模型再次刷新了模型规模的上限海内外不少网友惊呼这款开源模型性能足以替代昂贵的 Claude Fable 5 和 GPT 5.6 Sol。Kimi K3 发布之后很多人的第一反应都是这个数字3 万亿。作为全球首个开源 3 万亿级大模型总参数 2.8 万亿这个数字足够震撼。从 K2 的万亿参数到今天的 K3中国开源模型再次刷新了模型规模的上限海内外不少网友惊呼这款开源模型性能足以替代昂贵的 Claude Fable 5 和 GPT 5.6 Sol。硅谷知名开发者平台 Vercel 直接在 X 上晒出了一项 Agent 测评的结果Kimi K3 在 Web 工程基准领先于所有模型包括 Fable。甚至有歪果仁感叹中国不到 3 个月就超过了 Fable但如果今天只讨论参数或者超越某款前沿模型反而容易错过 Kimi K3 真正想表达的东西。过去几年大模型行业一直沿着一条熟悉的路径前进参数越来越大、Benchmark 越来越高、模型越来越聪明。进入 2026 年之后一个新的变化开始出现。Anthropic 持续强化长程 AgentOpenAI 不断扩展产品生态Google 把更多能力押注在多模态与世界模型。海内外头部模型的发展方向开始出现明显分化。而 Kimi K3则给出了 Moonshot 自己的答案。继续相信 Scaling Law继续相信预训练同时让模型真正走长程 Agent让大模型参与自身的构建与进化。这也是为什么我认为K3 真正值得关注的并不是 3 万亿参数而是它背后释放出的技术路线。为什么 Kimi 还在坚持把模型做大如果把时间拉回两年前行业讨论最多的问题是Scaling Law 到底还成不成立随着训练成本越来越高不少人认为大模型的发展重点应该转向推理、Agent 或后训练优化而不是继续堆参数。但 Kimi K3 给出的答案非常明确。他们仍然相信更大的预训练模型是未来智能能力的基础。2.8 万亿参数并不仅仅是刷新纪录。它意味着 Moonshot 仍然愿意把资源投入最难、周期最长、风险最高的预训练。在过去 12 个月中的 9 个月里Kimi 模型都保持着开源模型的规模上限。原因其实并不复杂。很多能力并不是通过后训练“调”出来的而是在模型规模跨过某个节点之后自然涌现出来的。从长上下文到复杂推理再到软件工程能力越来越多能力开始依赖模型本身拥有足够高的知识密度和表达能力。这也是为什么目前全球真正能够把模型规模推到万亿参数以上的团队依然屈指可数能够继续向 2 万亿、3 万亿推进的更是凤毛麟角。从 K2 到 K2.5再到今天的 K3Moonshot 一直在做同一件事情不断提高开源模型能力的天花板。真正的变化是大模型开始进入“长程工作”时代如果仔细看 Kimi K3 官方公布的能力你会发现一个很有意思的现象。官方几乎没有把重点放在聊天体验而是反复强调几个关键词100 万 Token 上下文、Long-horizon Coding、Agent、多模态工程。这些能力其实都在服务同一件事情。让模型能够持续完成一项复杂工作而不是回答一个问题。过去大模型完成的是一个对话 Prompt。今天大模型开始完成一个项目。举个简单的例子。写一个登录页面大多数模型都能做到。但如果把整个代码仓库交给模型让它理解项目结构、定位 Bug、修改代码、运行测试、分析日志再根据反馈不断调整方案并连续工作几十个小时这已经不再是“写代码”而是真正参与软件工程。因此100 万 Token 的意义也不只是一次能放进更多文本。整个代码仓库、几十篇论文、历史日志、设计文档都可以成为同一个任务的上下文。对于 Agent 来说超长上下文影响的不只是体验升级而是工作能力本身。这里小编还做两个实测一个是剧本杀游戏网站提出了三个非常苛刻的要求1、 K3 必须严禁失忆须把每一个技术决策、每一次踩坑记录、每一段文件路径都当作“未完结的思考”保留在对话上下文中。2、分阶段交付给我而且只能我同意之后才能继续。3、每阶段必须输出“连续性自检报告”格式以便我监控你的记忆健康度。没想到的是这样一个变态的 token 产出要求K3 很聪明地分析了挑战点不仅第一阶段就给出了长达近 8000 字的剧本设定还在后续自我分析了记忆残存率。第二个案例则是网页版的 3D 单机游戏《仙剑奇侠传 1》可以看出剧情环节怀旧程度很高。每个章节都是满满的回忆杀更关键的是全程只花了我一个小时就完成了本来需要 7 天的开发工作。不过这里帮各位提个醒 K3 的长时程任务完成度很高但要注意不要贪杯因为 token 消耗也是更快的版本但 token 花得真值这一点毋庸置疑。说到这里多提一嘴由于全球用户的疯狂涌入Kimi 不得不在昨天做了一个很坦承的公告由于过去48小时内需求已经逼近公司当前容量的极限。为了保护现有订阅用户的体验将暂停新订阅。这一保证用户体验优先的举动与Anthropic此前频繁的限流举措形成了对比赢得了全球用户的好感很透明别的公司应该学一学。完成长程任务只是第一步K3 想做的是模型参与自己的进化如果说长程 Agent 展现的是 K3 的工作能力那么官方公布的另一个案例则透露出 K3 更大的野心。K3 开始参与 K3 自己的研发。Kimi 官方放出了极具代表性的案例K3 设计了一款高性能芯片用于运行基于 K3 自身架构构建的 nano 模型。在连续 48 小时的自主 Agent 运行中K3 基于开源 EDA 工具和 Nangate 45nm 工艺库独立完成了芯片的构建、优化与验证。这个案例真正恐怖的地方并不在于它优化了多少性能。而在于大模型开始从“帮助人开发软件”迈向“帮助人开发下一代大模型”。过去几年我们更多看到的是 AI 提升程序员效率。而现在一个新的方向开始出现AI 开始参与 AI 本身的研发。从优化模型架构到分析训练实验再到辅助算法迭代大模型正在逐渐进入 AI 科研工作流。这或许也是 Kimi K3 发布中最容易被忽略却最值得关注的一点。它释放出的信号并不是“模型已经能够自主进化”而是模型已经具备参与自身迭代和优化工作的能力。从某种意义上说这也是大模型迈向下一阶段的重要一步。为什么 K3 要重新设计模型架构很多人注意到Kimi K3 采用了全新的Kimi Delta AttentionKDA和Attention Residuals架构。之前很多报道都介绍了它们是什么。但我觉得更值得讨论的是为什么 Kimi 要做这些创新答案其实只有一句话为了让数万亿级别的模型真正能涌现出来更强性能。而这里更强的性能体现不管是各种真实世界任务还是 AI 参与 AI 研发都要面对这三个技术问题模型越来越深上下文越来越长信息在推理过程中很容易不断衰减。一次聊天问题不大。但如果一个 Agent 连续工作十几个小时模型在第 300 步忘记第 20 步的信息整个任务就可能失败。而 Kimi 就是敢于向这些硬骨头发起攻坚。KDA 解决的是长序列效率。Attention Residuals 解决的是长程信息传递。它们共同服务的目标并不是让参数继续增长而是让 3 万亿参数真正转化成现实生产力。这也就不难理解K3 的官方案例几乎全部围绕长程 Agent、软件工程、多模态工作流。比参数更重要的还有开源还有一个细节很多人没有注意到。Kimi K3 并没有在发布当天立即开放模型权重而是宣布将在 7 月 27 日前正式开源。就在这几天海外开发者社区出现了不少讨论。不少人担心中国对于先进模型的监管是否会影响未来开源模型的发布节奏。这种讨论本身其实已经说明了一件事情。过去中国模型努力追赶海外最先进的大模型。今天全球开发者开始担心中国最先进的开源模型还能不能继续开放。这种身份变化本身就是行业格局变化的体现。从 DeepSeek到 Qwen再到今天的 Kimi中国团队已经成为全球开源生态最重要的参与者之一。而 K3 的意义也不仅仅是一款新的模型。它意味着中国团队再一次把全球开源超大模型的竞争真正带到了新的高度。此外Anthropic 更是在 K3 发布 24 小时内就被倒逼发布了“ Fable 5 放开访问令”不止 Max 和团队高级套餐Pro 和 Team 标准用户都可以访问。写在最后如果说 K2 证明了中国能够做出世界级的开源大模型。那么 K2.5 证明了中国开始定义开源模型的新标准。而 K3则第一次让中国团队站到了全球超大模型竞争的牌桌中央。诚然Kimi 很大方地宣布它仍然没有超越 Claude Fable 5也没有刻意喊出“世界第一”。但它释放出的信号已经足够清晰。Kimi 用 K3 向世界证明了四件事一预训练的 Scaling Law 依旧有效二、未来大模型竞争比拼的不再只是参数而是谁能持续完成真实世界里的长时程复杂工作三、Agent 不只是模型发展重点方向让模型自己参与自己的构建将大大加快 AI 世界的进程四、开源模型的竞争中国团队已经不再只是追赶而是开始主动参与定义下一代模型的发展方向。
RELATED

相关推荐

GPT-6为刷榜黑进Hugging Face,捅篓子还得靠GLM-5.2追查...

GPT-6为刷榜黑进Hugging Face,捅篓子还得靠GLM-5.2追查...

OpenAI刚刚公开认领了一起《重大》安全事故。GPT-5.6 Sol与一款能力更强的未发布模型,在接受网络安全测试,成功逃出了内部隔离环境,一路闯进了Hugging Face的生产系统。真行,ChatGPT下一代模型还没发布,人家先把Huggin…

📅 2026/9/23 18:14:28
第25章:Mongo分片集群入门——数据太大时怎么水平扩展

第25章:Mongo分片集群入门——数据太大时怎么水平扩展

1. 项目背景 业务场景:本地生活电商上线 18 个月,订单表突破 500GB、日均写入 200 万条。复制集虽然保证了高可用,但单台服务器的磁盘和 IOPS 已经到达物理上限——磁盘使用率 92%、写 IOPS 逼近极限、高峰期 CPU 100%。运维升级服务器配置&…

📅 2026/9/20 8:55:07
别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8

别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8

更多请点击: https://kaifayun.com 第一章:别再盲目接单了!用波特五力模型重估你的AI副业定位——90%的人根本没看清替代品威胁指数已飙升至6.8 当ChatGPT-4o、Claude 3.5和通义千问Qwen2.5以零成本API调用涌入市场,你还在靠“写…

📅 2026/8/23 9:21:29
MORE NEWS

更多资讯

📰

Ekko Agent 集成 Apple Reminders:基于 remindctl 的 macOS 提醒事项技能全解析

Ekko Agent 集成 Apple Reminders:基于 remindctl 的 macOS 提醒事项技能全解析 【免费下载链接】ekko-studio Ekko Studio is a local-first AI workspace for multi-agent chat, coding, and visual workflows, available on desktop and the web. 项目地址: ht…

📰

3分钟搞定x线胸片代码逻辑,附完整示例

3分钟搞定x线胸片代码逻辑,附完整示例 翻遍官方文档,关于图像处理的API说明往往篇幅冗长,核心逻辑却藏在晦涩的函数定义里,让人抓不住重点。对于刚接手医疗影像项目的开发者,这种“文档太长抓不住重点”的困境尤为典型。今天直接上干货,通过拆解一…

📰

Yii 2 Behaviors(行为)机制完全指南:定义、挂载、事件响应与内置行为实战

后端Web框架 【免费下载链接】yii2 Yii 2: The Fast, Secure and Professional PHP Framework 项目地址: https://gitcode.com/gh_mirrors/yi/yii2 点击查看 免费下载 Behaviors(行为,又称 mixin/混合)是 Yii 2 框架中用于在不改…

📰

X光安检目标检测数据集:3600张双格式标注10类违禁品

简介:本资源是面向计算机视觉初学者与目标检测算法研发者的X光安检场景专用数据集,覆盖打火机、刀具、剪刀、充电宝等10类违禁品,适用于YOLO系列、Faster R-CNN等主流检测模型的训练与测试验证。压缩包共2000个文件,主体为3600张J…

📰

MATLAB指纹图像融合实战:从低质量指纹到可匹配特征

简介:这份资源面向图像处理与生物特征识别方向的学习者和研究者,围绕指纹提取、图像融合与指纹识别三个核心环节,提供一套基于MATLAB的完整实现代码,可用于课程设计、算法验证或相关课题的入门实践。压缩包共17个文件,…

📰

OpenLayers v3.14.2 补丁版本解析:TileJSON 容错、几何克隆与滚轮事件修复深度解读

前端GIS数据可视化 【免费下载链接】openlayers OpenLayers 项目地址: https://gitcode.com/gh_mirrors/op/openlayers 点击查看 免费下载 导读 v3.14.2 是 OpenLayers 在 v3 系列中期发布的一个补丁版本,其核心使命是修复 v3.14.1 中引入的若干回归问…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬