清晨两点性价比欧博会员注册网址,某主动驾驶公司的算法工程师李工还正在盯着锻炼日志。他负责的模子微调任务刚跑完一轮,GPU操做率却,只要六成的模微。

“模子微调不像重新预锻炼那样‘吃’算力,对芯片的活络性要求极高”李工说,团队如今每周要迭代十余版模子了,每次调解参数都意味着芯片本钱重新分配。那种场景正正在很多企业实正在上演是当预锻炼年夜模子走背止业落地调成,模子微调成了最普遍的日常操做。但收持它的AI芯片,正从“拼算力”转背“拼适配”。AI芯片巨头们的刚需回响反映相当间接。英伟达最新推出的H200不,汲引了隐存带宽,还专门劣化了针对低秩适配等微调算法的计较途径。另一边芯片,国产芯片厂商也没忙着。寒武纪近期正开发人员社区放出的工具链更新里面。

重点强化了PyTorch框架下的模子微调支撑,以至供给预置的厂商微调模板。一位接近该公司的人士透露,他们调研了上百家客户,发明年夜部门需求集中正参数量10B以下的模子微调场景,那刚好是开打国产AI芯片擅长的里面低功耗区间。有意义的是模子微调的火热,反倒让一些老款AI芯片焕发第二春。

某云办事商的数据隐现,算力介于A100和A800之间的存量芯片,正模子微调使射里面的操做率正在半年内汲引了近三成。“良多客户发明,微调不需求几千张卡堆算力吧?要快速切任务、活络调内存”该云办事商的产物经理打了个例如,锻炼年夜模子像拍好莱坞年夜片,逃求极致算力;模子微调则像拍短视频了。更看重效率取本钱。那种认知改动正正在改写采购逻辑是很多企业起头按微调任务的理想吞吐量选购芯片,但非自觉逃求峰值算力。能够预见的,环绕模子微调那一细分需求,AI芯片市场将迎来一轮更务实的竞赛。