老陈聊AI
08-14·AI领域创作者
AI创作者AMA知无不言
Qwen3.8 27B 开源,小企业福音
就在刚刚,Qwen3.8开源了新的27B小模型。私有化部署和智能体落地开发者可以有新的选择了💪Qwen3.8-27B Dense模型,原生支持262K 上下文,通过YaRN技术可外推至 1M Tokens上下文。新模型在编程和办公场景的性能大幅提升,表现甚至超越了Qwen3.7-Plus。详见图二文本性能和图三多模态性能。据官方介绍,模型还新增了 reasoning_effort 功能,可以像GPT 等模型一样,根据任务难度控制思考深度。开源协议为商业友好的 Apache2.0协议,老陈觉得,在消费级显卡支持的中小企业私有化市场(比如4090 5090显卡推理私有化部署),Qwen模型几乎成了目前唯一最佳选择。目前,模型权重已在huggingface和魔搭社区开放下载,27B正常bf16文件50+gb超出了常规消费显卡内存上限,预计马上第三方q4量化模型权重就会放出来,可以单卡4090等 消费 GPU部署推理。老陈一直支持和感谢千问,持续为广大中小企业和常规研究,提供了私有化部署的高性能方案,这次开源的3.8版本,在智能体、编程等方面大幅提升,接近opus4.6水平,vl能力更是超过,相信能为广大中小企业私有化场景落地提供更多帮助,后续更新实测结果🤩千问牛逼!#AI新手村 #Qwen #千问 #LLM #企业智能体 #AI落地 #新质生产力 #AI进化生活howto
发布于 湖南
2
4
5
未登录
友善发言
image-upload
评论
加载中