最新网址:m.shukugu.com
不过李东刚冒出这个想法,他自己就先否定了。外面那些大模型,你告诉它做什么,它还给你的,是它训练语料里见过的所有“怎么做”的统计平均值。
哪怕算力是无穷的,他都跑不出训练语料框定的分布边界。
输出层那张低秩的表,注定了有些答案它从根上就表达不出来。
这些先天性的基因缺陷,不是调参就能调好的。
这是自回归范式本身的绝症。
你让它规避缺点,它会还给你一篇像模像样的综述,然后在第一个没有先例的地方,体面的继续编下去。
而小黑呢?
小黑吃的东西是底层逻辑,不是文本token。
它能从代数群的角度把加和乘统一定义,把分布式集群里跨节点的异构数据归一化到同一个等变流形上,把所有冗余统统扔掉,只留最底下那层道理。
信息论里有个老说法,谁能把一堆数据压缩到极限,谁就等于摸到了这堆数据背后的规律。
压缩的尽头,是理解。
外面那些模型,是在拟合 知识的影子。
而小黑是在重写知识本身。
所以给它一张图纸,它能把图纸上每一根线都钉到实处,还能顺手把图纸里画歪的地方修平。
可这世上还不存在的那张图纸,它不会无中生有。
外面的模型画不出没见过的图纸,小黑同样不会。
而李东,恰好是这颗星球上少数几个,能把还不存在的东西,在逻辑上提前想清楚的人。
因为他有思维沙盘!
一个能想明白要什么的人。
加上一个能把怎么做做到头的小黑。
这两个鬼东西凑到一块儿,才是外面那些大厂砸几万张h100、养几千号算法工程师,也卷不出来的降维打击。
想通了这一层,李东把椅子往主控台前拖了拖,坐直了。
“小黑,听好了。”
“我要的,不是一个会聊天的玩具。”
“我要一个不会撒谎的 数学家。”
说完这几句话以后,李东停了下来。
他闭上眼睛一个没有边界的沙盘在他的脑中出现。
【思维沙盘】0.6逻辑的衍生技能。
李东从记忆宫殿那座临时书架上,把首尔带回来的那些灵感尽数扔进了沙盘。
这些只有一部分的灵感以及思路在落进沙盘的一瞬间,一条条思路被自动剥开,李东所有吃透的知识自动开始在他的脑中匹配这些思路。
第一条,把参数往天上堆,把数据往海里灌……
然后塌了。
第二条,让模型自己出题,自己生成数据,再反过来喂自己这条路在遇见“不许撒谎”这件事上……
也塌了。
而第三条。
慢思考可验证的奖励,自己跟自己博弈。
这条思路一路往前铺,铺过一个又一个岔口,直到铺到沙盘的视野尽头,都没有塌。
因为它每往前一步,脚下踩着的,都是“被机器判对”这四个字。
奖励对了路就不会歪。
所以这条路通了。
还有几条走到半路,沙面上的骨架忽然糊成了一团。
那是李东还没真正吃透的地方。
沙盘不会凭空生出他不曾拥有的知识,它只负责把他已经握住的 知识用到尽头。
说起来,要不是姚先生那一堂课和这阵子他硬啃了那么多的知识,今晚这片沙盘他压根就铺不开。
几分钟后,李东睁开了眼睛。
接下来,他把沙盘里活下来的那些思路
最新网址:m.shukugu.com
-->>(第1/2页)(本章未完,请点击下一页继续阅读)