神奇的收藏家
08-11·朝阳工作室员工
Claude自研芯片,不靠英伟达跑模型
Taalas把大模型烧在芯片上!
Taalas走出一条反常识路线,直接把大模型权重硬编码蚀刻进芯片,跑出17000Tokens/秒的推理速度,绕开传统GPU的内存墙瓶颈。代价是牺牲通用性,一颗芯片基本只适配单一模型。AI硬件赛道开始分化,通用GPU与专用ASIC各有取舍,做技术的同行觉得这种固化模型的方案,会成为推理端的主流方向吗?
发布于 山西
分享
评论
未登录
友善发言
image-upload
评论
加载中