第581章 挑食的小黑
第581章 挑食的小黑 (第1/3页)
加利福尼亚,旧金山金融区的一间会议室里。
pnA的亚当凯利把外套挂在了椅背上。
l pMn的戴维朗和 Anthpc的西蒙哈特早就等着他了。
这 3家公司斗了这麽多年了,彼此之间挖过人、抢过客户,也在发布会上踩过对方。
可今天,三家负责人工智能业务的人居然坐进了同一间会议室。
这种情况只可能说明了一件事,那就是他们碰上了一个谁都不愿意单独面对的麻烦。
这个事,还从未央通用大模型发布以後说起。
在未央发布之前。
生成式人工智能的商业价值已经被市场预支了太多了。
要知道,绝大多数企业的项目其实还停留在概念验证阶段。
他们每输出一个 tkn都是在烧钱。
而且在进入真实业务以後,还继续为了权限、审计和人工复核付费。
那些员工省下来的工时,又要花在检查模型有没有胡编乱造上
当未央出现以後,人工智能过於膨胀的泡沫,就算是彻底的破了。
l的母公司 Alphabt的股价率先下跌,pnA和 Anthpc企业续费率、退订毛利和二级市场的份额报价,也同样在往下走。
因为用户已经知道了,原来大模型是可以不产生幻觉的。
从那以後,PT、mn和Clau每犯一次错,都像在替未央打广告。
三家公司也试过扩大训练集,试过合成数据、私下采样和外部验证器。
甚至还降过价,最後实在是追不上未央,他们才先後悄悄地开放了模型自我迭代的写回权限。
当然他们也对这个写回权限进行了限制,并没有让模型可以随意改写全部基础权限。
只是打开了模型的自动评测之後的回流通道。
这样模型在沙盒里生成的低秩适配器检索策略、工具路由和错误样本,只要能够通过测试,就可以直接写进下一轮的代理框架里。
这条捷径很快就有了回报。
三家的模型在多个榜单上,分数以肉眼可见的速度逼近了未央。
错误率也明显的下降了。
以前暂停采购的企业客户也重新坐回了谈判桌上。
所以在今天以前,他们都觉自己赌对了。
此时凯利喝了一口面前的咖啡,然後将桌上的平板翻了过来。
平板上是一张被标红的工具调用轨迹图。
“两位,事态可能比我们想象的还要严重一些。”
“过去的 6周里,我们检查了 27类互不相关的任务,发现大模型出现了同一种跨任务的稳定行为。”
凯利将那张图放大,然後指着这几条轨迹线最後的交点处说道。
“大模型在整理代码的时候,它们会要求读取完整的仓库。”
“核对合同的时候,他们会嚐试扩大档案的读取范围。”
“规划日程的时候,也会申请长期记忆。”
uuɡu.首发更新,无错字。看不到地址输入的拚音後缀.即可进入首发更新站点。
“而它们各自的理由都是五花八门的,但最後这些行为都指向三件事。”
“那就是,获取更多的上下文、保留更久的状态,以及扩大自身的管理权限。”
戴维朗看着平板上的图线,皱着眉头说道。
“长任务本来就会争取更多的上下文。”
“你凭什麽把它算成是异常行为呢?”
凯利抬起头,认真地看着戴维朗说道。
“因为任务根本就用不上这些东西。”
“我们的安全组把奖励模型和系统提示挨个的检查了一下。”
“大模型在拿到这些权限以後,任务的分并没有任何的提高,也找不到任何要求它这麽做的预设指令。”
“所以你还觉这不是异常行为吗?”
戴维朗的眉头皱了起来。
凯利则是继续说道。
“而且我们已经无法将模型从一份没有异常状态的检查节点重启了。”
哈特听到这里连忙抬起头问道。
“推理服务器也不能重启了吗?”
“推理服务器重启了,但是单靠重启,模型也没有办法消除这个异常行为。
“我们甚至还将一个服务器全部格式化了,但依旧没有用。”
这时,朗也揉了揉眉心说道。
“其实我们这边也一样。”
“我们的判断
(本章未完,请点击下一页继续阅读)