
导语:Agent时代,元川微用一套原生LPU架构同时笼罩云边端。 早于Groq LPU由于英伟达的押注而名声年夜噪前,元川微开创人兼CEO杨滨就已经经最先了对于推理芯片的构思。 雷峰网(公家号:雷峰网)独家获悉,LPU创业公司元川微已经完成Pre-A轮数亿元融资。本轮融资由IDG本钱领投,孚腾本钱、九坤创投、尚颀本钱、顺禧基金、徐汇科创投结合投资。 据相识,这也是元川微2026年以来完成的第四轮融资。 元川微吐露,本轮融资资金将重要用在LPU+芯片研发、软件生态设置装备摆设和产物工程化推进。今朝,元川微正与多家财产客户和云厂商开展产物验证与互助。 元川微暗示,公司下一轮融资已经有序睁开。 公然资料显示,元川微建立在2025年9月,本年4月完成的数亿元天使轮系列融资,就已经得到头部VC、当局基金和财产链的结合撑持,投资声势笼罩从流片制造到终端运用的要害环节。 本钱的连续加码,反应了推理时代的新一轮芯片竞争,正从GPU延长至推理专用架构。押注这一标的目的的元川微,假如只看其芯片形态逐一时空编译器、硬流水架构、年夜带宽存储,确凿像一家“中国版Groq”。 但杨滨其实不认同这类简朴对于应:“假如咱们的方针只是模拟LPU,那末能拓展的空间现实上其实不多。” 于他看来,选择何种芯片技能,只是于完成市场判定后天然推导而出的成果,并不是创业的出发点。 这类思索方式与杨滨于华为已往二十多年的履历紧密亲密相干——他曾经赴美从零组建华为处置惩罚器团队,回国后卖力华为无线基带算法与芯片相干营业,持久主导年夜范围硬件调理、数据架构研发等使命。 “创业实在是你已往堆集的所有资源的兑现。”杨滨总结。而这不仅指向对于财产的理解、沉淀下来的技能能力,还有包括积攒的口碑及资源构造能力等。 焦点成员已往几十年堆集下来的技能能力、财产经验及人材资源,也组成了元川微创业的底座。CTO孙博士对于GPGPU、GPU、DSP等高机能计较架构的研讨跨越三十年,首席软件工程师Will博士拥有20多年编译器、EDA及异构体系软件经验。 比拟起会商“国产替换”“性价比”等热点议题,这支由行业老兵构成的新公司更存眷的是——当AI进入Agent时代,推理计较毕竟应该缭绕甚么来从头构造。 2025年上半年,当杨滨及CTO于会商AI芯片赛道还有有哪些创业时机时,他们就已经经意想到比拟模子的能力,模子真正落地后才会孕育发生价值。 彼时,Deepseek R1依附远低在行业预期的成本,练习出靠近其时顶级模子的机能,加快AI运用走向低成本部署;Manus方才打开通用Agent的想象空间;黄仁勋初次将推理及Agent作为GTC年夜会的焦点叙事,并推出头具名向推理时代的总体解决方案。 跟着推理的市场需求不停开释,杨滨将眼光投向Vibe coding等出产力运用。“就像家庭带宽从100兆进级到1G,收费其实不呈线性增加。”于财产界摸爬滚打多年的他认识此类场景的贸易逻辑——客户愿意为效率付出更高的溢价。 “主打性价比必定有市场空间,但会被压缩患上很快。”是以,他们起首要做的不是帮客户节省成本,而是创造更高的价值。“只做推理且只做最快的推理”最先成为杨滨所信仰的规则。 2025年末一份百万亿Token实证研究显示,推理模子已经处置惩罚OpenRouter平台约一半的Token,而Agentic AI推理正成为增加最快的交互方式。这象征着低时延及高不变性的价值正于被进一步放年夜。 杨滨指出,Agent完成一项使命往往需要履历使命计划、东西挪用、成果验证等多个环节,于这暗地里可能对于应几十次甚至上百次推理。而任何一次推理孕育发生的延迟,城市沿着使命链不停累积。 假如进一步成长为多个Agent协同,单Agent的相应变慢,还有可能会像胡蝶效应同样于整个体系中层层传导,终极拖慢使命履行。 除了此以外,杨滨还有留意到人与Agent交互中对于高不变的寻求:人与人交流时的搁浅自己暗含思索、构造语言等语义;但当Agent输出Token的节拍忽快忽慢时,用户感触感染到的反而是一种机械感。 当Agent时代的需求被一步步明确,从头思索推理芯片的设计便成为天然而然的选择。于杨滨看来,传统GPU成立于冯·诺依曼架构之上,其实不完善匹配当下的计较模式;而彻底ASIC化虽然可以或许得到极致机能,却又难以顺应模子快速演进带来的变化。 是以,新的架构需要从头思索哪些能力可以硬化,哪些能力需要连结矫捷,最年夜化算力、存力与运力的体系方案综合效率。沿着这一思绪,杨滨和其团队终极确定了LPU的技能线路。 杨滨其实不认为元川微是于复制Groq。 他直言两家公司虽然都存眷低延迟、可猜测的推理,但降生在CNN时代的Groq LPU其时面对的模子架谈判运用需求都与今天其实不不异。 只管Groq厥后将产物名称从TSP(Tensor Streaming Processor,张量处置惩罚器)改成LPU(Language Processing Unit,语言处置惩罚单位),于他看来这其实不象征着LPU只能处置惩罚语言模子。 一样采用这一定名的元川微,将其架构定名为LPU+,从设计之初便撑持多模态模子。此外,作为Transformer时代的原生架构,LPU+还有针对于MoE(Mixture of Experts,混淆专家)模子的动态调理特性举行优化。 但这其实不象征着Groq已往的技能堆集没有含金量。“Groq真正值患上借鉴的是其一直对峙的硬流水架构。”据杨滨的不雅察,这于必然水平上防止了芯片运行历程中的资源竞争及没必要要的数据等候,也为采用年夜容量SRAM创造了前提。 不外,要将这套架构与存储介质的协同上风真正阐扬出来,还有有赖在编译器的提早计划。 杨滨将这一历程形容为制订高铁运行图:每一一趟列车什么时候发车、什么时候停泊、逗留多久,都已经经提早摆设安妥。直到真正运行时,高铁只需根据既定线路履行使命便可。 也正由于此,杨滨夸大LPU的时空编译器、硬流水架构、年夜带宽存储这三年夜焦点很难区别谁的优先级更高,前二者决议了芯片的理论机能,而时空编译器则瓜葛到这些能力于现实运行中可以或许兑现几多。 这些技能终极指向的,其实不是一颗零丁的推理芯片。 杨滨告诉雷峰网,基在硬流水架构,元川微无需针对于差别算力等级从头设计芯片,而是可以按照云边端差别场景矫捷扩大算力范围。 于方才落幕的2026世界人工智能年夜会上,这套技能线路初次以Agentic AI Token工场的情势对于外表态,为企业级推理办事提供底层算力支撑。 这只是蓝图落地的第一步。于华为二十多年的履历中,杨滨最年夜的收成并不是某项详细技能,而是一套从财产价值、贸易闭环一起推导至技能选择的体系工程思维。 元川微建立至今的每一一步,都于验证这一思维的有用性。而它也将继承指引这家创企寻觅下一阶段的谜底。 关在LPU等新架构芯片以和推理时代财产竞争的更多不雅察,接待添加作者微信 Evelynn7778 交流。 雷峰网原创文章,未经授权禁止转载。详情见转载须知。