Skymizer发布全球首颗LLM专用芯片HTX301

描述

近日,台湾AI推理芯片厂商Skymizer(发展软件科技)正式发布 全球首颗大语言模型专用ASIC芯片HTX301 ,同步宣布与凌烟阁芯片科技(LYG)达成战略合作。双方将联合开发新一代LPU ASIC推理芯片,推动LLM大模型AI系统在边缘服务器、工业设备、本地终端等场景的商业化落地。

一句话概括:一颗专用芯片,240W功耗,单卡跑700B参数大模型——而且不用HBM。

HTX301的设计思路与主流GPU方案有本质区别。

当前大模型推理分为两个阶段:Prefill(预填充) 是计算密集型,Decode(解码) 是带宽密集型。GPU的问题在于,它把两个阶段硬塞在同一块硅片上,导致算力和带宽总有一个在空转。

HTX301只做一件事—— 专攻Decode阶段 。它基于Skymizer自研的 HyperThought™软硬件协同设计平台 ,搭载专有的 LISA™(Language Instruction Set Architecture)v3指令集架构 ,专为Transformer推理优化,天然适配带宽密集型负载。

对比之下,英伟达RTX PRO 6000 Blackwell执行同类任务功耗约600W,AMD Instinct MI350P同样远高于此。HTX301用不到一半的功耗,跑同级模型,且不需要改造数据中心的电力和冷却系统。

这背后的核心逻辑是:推理已经成为AI时代最主要的应用场景,但基础设施还停在训练时代。HTX301要做的,就是把推理从GPU的垄断中解放出来。

Skymizer的商业模式以IP授权为核心,而凌烟阁正是它在中国大陆及东南亚市场最关键的落地伙伴。

双方的分工非常清晰:

角色职责
Skymizer提供HyperThought™ LPU AI推理IP、HTX301芯片架构、LISA指令集及软件栈
凌烟阁(LYG)负责后端设计整合(APR & Design Integration)、工艺协同优化(DTCO)、系统级软硬件适配、下游场景导入与销售推广

初期合作聚焦芯片设计层面:后端布局实现、设计工艺协同优化、多模态时序收敛。

长期合作延伸至AI系统平台:LLM系统整合与应用开发,加速大模型在不同算力部署需求下的场景落地。

凌烟阁在横琴、上海、深圳、澳门均设有研发中心,具备从芯片设计服务到政企、工业场景客户拓展的成熟能力。对Skymizer而言,这意味着HTX301不用自己从零建渠道,可以快速导入国内海量应用市场。

合作不是画饼。凌烟阁基于HTX301已经开发出多个AI应用方案:

应用场景方案名称核心价值
智慧办公智慧会议系统本地部署,数据不出企业
芯片设计RTL Coding CopilotRTL代码不上云,保护核心IP
游戏娱乐在线游戏Companion低延迟本地推理,提升交互体验
教育开发凌烟派LLM教育开发板降低大模型学习与实验门槛

这些方案的共同特点是:全部本地运行,数据不出本地,隐私可控。 在企业级市场,这是比性能参数更硬的卖点。

过去两年,AI行业的叙事一直围绕GPU展开。但推理才是AI真正产生商业价值的环节——训练是一次性投入,推理是持续性消耗。

当700B级别的模型开始进入企业本地部署需求时,GPU方案的成本和功耗变得不可接受。HTX301用240W、28nm制程、LPDDR内存跑通了这条路,证明了一件事:

推理不需要堆HBM,不需要堆制程,需要的是架构上的专精。

Skymizer董事长赖俊豪的判断很直接:"推理已成为AI时代最主要的应用场景,基础设施与终端产品也需随之演进。"

凌烟阁CEO李宏俊则点明了商业目标:"助力HTX301在中国大陆及东南亚的销售与推广,同时推进下一代LLM芯片开发。"

国产端侧AI算力的国产化替代正在提速。通用GPU成本高企制约着大量中小厂商的大模型落地,而专用LPU芯片打开了一条低成本、高能效、可本地部署的新路径。HTX301的发布和凌烟阁的加入,让这条路径从PPT走向了货架。

打开APP阅读更多精彩内容
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉

全部0条评论

快来发表一下你的评论吧 !

×
20
完善资料,
赚取积分