• 首页
  • 上一页
  • 目录
  • 下一页
  • 书架

《我的学习群里全是真大佬》

第581章 挑食的小黑

    然而小黑点还是没有任何的反应。

    “难道是这些东西太难了?”

    “小黑现在回到初始状态,吃不下了?”

    想到这里,李东又去把义务教育阶段的数学、物理和自然科学这些材料全都下载了下来,然後扔到了对话框里。

    小黑点依然没有反应。

    只是头上再次弹出了【Huny。】

    【小黑,你变了,你开始变挑食了。】

    就在李东吐槽小黑的时候,他的电话响了。

    是姚先生打过来的。

    “喂,姚先生。”

    “李东院士,你的身体无碍了吧?”

    “嗯,已经没事了,谢谢姚先生关心。”

    “没事就好。”

    姚先生轻轻一笑然後说道。

    “今天我给你打电话主要是诺维格教授刚刚和我聊了一件事。”

    随後姚先生就将那三家模型开放自我迭代写回权限的事,以及诺维格在测试中发现异常的情况,都简单的说了一遍。

    李东听着听着,就皱起了眉头。

    “写回权限?”

    “对。”

    “现在我们还无法确定,这是商业目的留下的漏洞,还是在线自我迭代引起的目标误泛化。”

    “可无论是哪一种,都很有可能危及到用户的隐私。”

    李东点了点头。

    模型的自我迭代最危险的地方,从来都不是它会多写几行代码。

    真正危险的是模型提出的改动如果出现偏差不需要经过人工审核,就会被写进下一轮。

    这样,这些偏差也会被保存下来,经过一轮又一轮的强化学习,最终让模型偏离人类的意图。

    这样的偏移可能不会让大模型产生人格意识,可是它依然可以把偏离人类意图的策略变成实际操作,进而误用权限、泄露数据,对用户造成真真实实的危害。

    姚先生说到这里,叹了口气。

    “李院士啊,其实我是有点担心未央。”

    “担心未央?”

    “嗯。”

    要知道,直到现在,未央依旧在综合推理和软件工程等公开的基准上,断层领先其他的任何大模型。

    而外界只知道未央很强,却不知道公开服务器里的未央只开放了完整能力的大约 6成而已。

    姚先生此时接着说道。

    “国外的那些模型就算出现异常,外层的权限系统应该还能拦住他们。”

    “但未央……”

    “它实在太强大了,到现在为止,它没有出现过一次可复现的幻觉。”

    “本来未央的工具使用和常规能力就强於这些模型,现在再加上它连这种能让我们看见的破绽都没有。”

    “如果发生了同样的目标偏移,我们可能连发现都发现不了。”

    听到这里,李东也明白姚先生在担心什麽了,他笑着说道。

    “姚先生,您放心。”

    “未央一直在我们的掌控中。”

    开什麽玩笑?

    未央可是小黑弄出来的,市面上的那些大模型能和它比?

    从底层的架构上就完全不一样好吗?

    而且每一次的能力变化都有小黑盯着,怎麽可能出现同样的情况?

    小黑可以为未央加新的能力,但这些能力都只能以独立模块的方式接入。

    根本就没有办法直接改写只读的基础检查点。

    而且每个模块都要先通过独立的验证,从生成到接入,每一步都会留下带签名的状态转换记录。

    没有李东的确认,未央根本就无法进入公开服务。

   

    -->>(第3/4页)(本章未完,请点击下一页继续阅读)
  • 加入书签
  • 上一页
  • 目录
  • 下一页
Copyright shukugu.com 返回首页
顶部