陆知远在键盘上敲击几下。
屏幕上切换出一份全新的文档。
标题是《端侧AI专用NPU性能要求清单》。
余大嘴身子前倾,眼睛盯着大屏幕。
只看了前几行,他的眉头就紧紧皱了起来。
“顾总,你这要求是不是有些离谱?”余大嘴指着屏幕,
“底层逻辑彻底重写?核心功能全硬件级加速?连内存缓存都要原生支持?”
余大嘴念出这几个苛刻的条件,脸色变了。
“这根本不是市面上那些通用AI芯片的路子。”
顾屿点了点头。
“没错。”顾屿靠在沙发上,语气笃定,
“市面上那些传统的AI架构,用来处理图像识别还凑合。但用来跑自然语言大模型,效率实在太低。”
顾屿的话很直接。
其实他这是在强行改变海思的技术路线。
前世华为在这个节点上走了一段弯路,先是买了第三方通用的授权,结果发现算力和架构根本无法满足自家业务需求,最后才痛下决心花了一年多时间重新自研专用架构。
顾屿现在要做的,就是让华为把这浪费的一年多时间省下来。
“这几项硬性指标,是让手机端AI跑起来的前提条件。”顾屿敲了敲桌子。
余大嘴盯着那些极高的内存与缓存参数指标:
“你这等于是让我们把整个计算通路全部推倒重来!不仅如此,高通和苹果现在都在拼命堆通用算力,你却要求我们把宝贵的精力全花在这些单一的深度学习功能上?”
“这是你们必须迈过去的一道坎。”顾屿声音平稳。
“手机端AI卡顿的真正死穴,从来不是算力够不够,而是数据传输的通道不够宽。”
“生成一句话,需要把庞大的模型权重反复读取。如果不用专属的物理电路去跑,手机主板上的数据通道根本扛不住这种高频次的读写,跑不了两句话系统就会卡死。”
余大嘴没有说话,目光停留在功耗那一栏上。
上面写着两个极为严苛的数字:满载功耗必须小于3W,平时对话功耗必须压在1.5W以下。
“顾总,你们雅安机房里的云端NPU敢跑到三百多瓦,那是因为有大型机房空调猛吹着!”
余大嘴用手指重重敲打着茶几,
“手机里这么小的空间,根本没有主动散热。要塞进去这么高
本章未完,请点击下一页继续阅读!