此时我们组的其他成员也露出了微妙的表情。
“一个个这种表情干什么我刚才什么都没说。”
看著眾人的士气瞬间提了起来,沈飞也开始耍赖。
“我刚才耳聋了,你说什么”
隨著一个人的带头,其他人纷纷附和,毕竟这一段时间吃的苦,其他友商的工程师也一定要好好吃一下。
【其他友商的工程师:……】
“坑有啥只不过是个小插曲,但本地模型还是要好好做的,毕竟有些地方,还是需要端侧模型的。”
“把你们的模型架构图调出来我看看。”
张磊看到老板要指导工作,连忙把复杂的模型图投到了大屏幕上。
沈飞扫了一会,心里就有数了。
团队的思路没问题,就是传统的模型剪枝量化那一套,能挖的潜力基本上都挖完了。
靠他们自己慢慢磨,说不定再熬半年就能摸到门槛,但时间太久了,他等不起。
他要开掛。
於是他伸手从口袋里掏出个u盘放在了工作檯上。
“这里有一套新的语音模型架构,还有配套的压缩算法。
你们照著这个方案改重新训练模型。”
“新架构。”
虽然张磊有点疑惑,但还是快速地从沈飞手里接过来那个u盘,毕竟传音实验是第一定律,老板的实力不要质疑。
“对。
这个模型採用了轻量化动態网络结构,不用暴力剪枝。
能在保证98%识別率的前提下,把模型体积压缩到原来的十分之一。”
“十分之一。”
周围的几个工程师都凑了过来,脸上全是好奇之心。
毕竟他们的模型已经压缩到了8gb,那压缩后的结果就是800b
这个大小的模型,还能做到0.3秒的响应,这听起来就是天方夜谭。
“別在那里傻愣著了,考进去试试。”
沈飞指了指他们。
张磊回过身,赶紧把u盘插进电脑。
打开文件夹,里面不仅有完整的架构代码,还有详细的训练指南和优化笔记,甚至连常见的坑都已经標註清楚了。
他越看越激动,毕竟这套架构採用了一种他们想都没想过的方式,解决了模型体积和准確率的矛盾。
就像有人在死胡同里,直接开了一扇新的大门。
“这……这也太牛了……”
“动態路由分配算例,用小模型拼接出大模型的效果……我们之前怎么没有想到呢”
张磊直接傻眼了,果然有名师指导,瞬间就可以醍醐灌顶,古人诚不欺我。
“现在想到也不晚。”沈飞笑了笑,“给你们一周的时间,把模型调教好,能做到吗”
“能。”
张磊和一眾工程师连连点头。
“別说一星期,给我们两天就行,或者说上发布会都没问题。”
“不用那么著急,这是等產品进入平销期拉热度用的。
不过你们可以提前爆料,吸引一下同行的工程师。”