��错就是错,中间不留半点含糊的余地。
这麽一来,模型再想信口胡诌也诌不下去了。
姚先生听完,笑着瞥了李东一眼。
“我明白了。”
“你这是来拉我入夥的,对吧?”
李东笑得有点腼腆。
“姚先生,被您看出来了。”
姚先生摇了摇头。
“你的意思,我懂。”
“可我现在,是真没那个精力喽。”
“年轻那会儿,恨不得一天掰成两天用。”
“到了我这岁数,脑子还转得动,可身子骨已经跟不上了。”
“一个基座大模型从头 Train到尾,那是拿命去填的算力黑洞,我填不动了。”
老人的语气里带着点遗憾。
“能做的也就是给你们多带几个好苗子出来,往你们这边送几点新鲜血液,栽树的人不一定坐得上树荫,这就到顶了。”
李东的脸上,适时地浮起了一抹失望。
看着他这副表情,姚先生差点没绷住。
太假了。
这小子,连演戏都不会演。
不过姚先生也没去拆穿他,而是顺着他那点失望往下说道。
“你也别失望。”
“人,我倒是还能替你介绍一个,唐杰,唐教授。”
提起唐杰这个名字,智班的学生没有不熟的。。
水木计算机系的讲席教授,头顶着 ACM、AAAI、IEEE三料大满贯 Fellow。
早在 2006年,他就带着实验室搞出了 AMiner,一个能把全球学术情报连根拔起的大数据系统。
到了 2019年,外面的大厂还一窝蜂卷在计算机视觉里,他偏偏押宝了当时冷门的自然语言和知识图谱,一手拉起了智谱。
真正让他在国际上封神的,是那套 GLM架构。
那时候外面的大模型要麽学 OpenAI搞 GPT的自回归生成,要麽学谷歌搞 BERT的双向理解。
唐杰偏要把这俩路塞进一个壳子里,硬生生蹚出了一条“自回归填空”的野路子。
到了 2022年,水木和智谱一起直接开源了千亿参数的 GLM-130B。
那一年斯坦福搞了个大模型硬核评测,几十个巅峰模型里,唯一杀进榜单的亚洲面孔,就是它。
在准确性、公平性这些零样本测试指标上,它硬刚 GPT-3不落下风,有几项测试跑得甚至更稳当。
如今智谱都已经敲了锺,成了资本圈里逢人便提的“全球大模型第一股”,市值一度逼得国内几家老牌大厂都得回头看一眼。
一个做学问的教授,没去跟风炒概念,愣是把一件本该是矽谷巨头砸钱才玩得转的事,给做成了。
说起来这条以教授身份下场、把学术界的前沿直接干成产业界天花板的路子,几年前有个姓陆的院士也干过。
如今唐杰算是又把这条路干了一遍。
就在姚先生说完的瞬间,李东立马说道。
“好。”
这反应快得,倒让姚先生都愣了一下。
他又好气又好笑地摇了摇头。
到底是上午刚跟他过了几招的人,肚子里那股劲儿,藏都藏不住。
UC小说网_m.shukugu.com