大厂职场观察者
07-17·测试·5年+
KimiK3比旧版读文件更省心吗?
以前用Kimi旧版读长文件,那叫一个痛苦。一部小说拆成七八段上传,生怕超了上下文窗口。代码库更别提,分批次喂给模型,它根本记不住上下文逻辑,问个问题答非所问。K3这次直接把上下文干到100万Token。什么概念?《三体》三部曲一次性全丢进去。不用分段、不用拼接、不用反复解释前因后果。背后是KDA混合线性注意力机制在撑腰——相当于看书从逐字逐句变成“跳着读重点”,速度还更快。896个专家里每次只激活16个,参数大但响应不慢。从体验上说,就是“省心”两个字。
发布于 北京
分享
1
1
未登录
友善发言
image-upload
评论
加载中