《我的学习群里全是真大佬》
第581章 挑食的小黑然而小黑点还是没有任何的反应。
“难道是这些东西太难了?”
“小黑现在回到初始状态,吃不下了?”
想到这里,李东又去把义务教育阶段的数学、物理和自然科学这些材料全都下载了下来,然後扔到了对话框里。
小黑点依然没有反应。
只是头上再次弹出了【Huny。】
【小黑,你变了,你开始变挑食了。】
就在李东吐槽小黑的时候,他的电话响了。
是姚先生打过来的。
“喂,姚先生。”
“李东院士,你的身体无碍了吧?”
“嗯,已经没事了,谢谢姚先生关心。”
“没事就好。”
姚先生轻轻一笑然後说道。
“今天我给你打电话主要是诺维格教授刚刚和我聊了一件事。”
随後姚先生就将那三家模型开放自我迭代写回权限的事,以及诺维格在测试中发现异常的情况,都简单的说了一遍。
李东听着听着,就皱起了眉头。
“写回权限?”
“对。”
“现在我们还无法确定,这是商业目的留下的漏洞,还是在线自我迭代引起的目标误泛化。”
“可无论是哪一种,都很有可能危及到用户的隐私。”
李东点了点头。
模型的自我迭代最危险的地方,从来都不是它会多写几行代码。
真正危险的是模型提出的改动如果出现偏差不需要经过人工审核,就会被写进下一轮。
这样,这些偏差也会被保存下来,经过一轮又一轮的强化学习,最终让模型偏离人类的意图。
这样的偏移可能不会让大模型产生人格意识,可是它依然可以把偏离人类意图的策略变成实际操作,进而误用权限、泄露数据,对用户造成真真实实的危害。
姚先生说到这里,叹了口气。
“李院士啊,其实我是有点担心未央。”
“担心未央?”
“嗯。”
要知道,直到现在,未央依旧在综合推理和软件工程等公开的基准上,断层领先其他的任何大模型。
而外界只知道未央很强,却不知道公开服务器里的未央只开放了完整能力的大约 6成而已。
姚先生此时接着说道。
“国外的那些模型就算出现异常,外层的权限系统应该还能拦住他们。”
“但未央……”
“它实在太强大了,到现在为止,它没有出现过一次可复现的幻觉。”
“本来未央的工具使用和常规能力就强於这些模型,现在再加上它连这种能让我们看见的破绽都没有。”
“如果发生了同样的目标偏移,我们可能连发现都发现不了。”
听到这里,李东也明白姚先生在担心什麽了,他笑着说道。
“姚先生,您放心。”
“未央一直在我们的掌控中。”
开什麽玩笑?
未央可是小黑弄出来的,市面上的那些大模型能和它比?
从底层的架构上就完全不一样好吗?
而且每一次的能力变化都有小黑盯着,怎麽可能出现同样的情况?
小黑可以为未央加新的能力,但这些能力都只能以独立模块的方式接入。
根本就没有办法直接改写只读的基础检查点。
而且每个模块都要先通过独立的验证,从生成到接入,每一步都会留下带签名的状态转换记录。
没有李东的确认,未央根本就无法进入公开服务。
-->>(第3/4页)(本章未完,请点击下一页继续阅读)