第581章 挑食的小黑

    第581章 挑食的小黑 (第1/3页)

    加利福尼亚,旧金山金融区的一间会议室里。

    pnA的亚当凯利把外套挂在了椅背上。

    l pMn的戴维朗和 Anthpc的西蒙哈特早就等着他了。

    这 3家公司斗了这麽多年了,彼此之间挖过人、抢过客户,也在发布会上踩过对方。

    可今天,三家负责人工智能业务的人居然坐进了同一间会议室。

    这种情况只可能说明了一件事,那就是他们碰上了一个谁都不愿意单独面对的麻烦。

    这个事,还从未央通用大模型发布以後说起。

    在未央发布之前。

    生成式人工智能的商业价值已经被市场预支了太多了。

    要知道,绝大多数企业的项目其实还停留在概念验证阶段。

    他们每输出一个 tkn都是在烧钱。

    而且在进入真实业务以後,还继续为了权限、审计和人工复核付费。

    那些员工省下来的工时,又要花在检查模型有没有胡编乱造上

    当未央出现以後,人工智能过於膨胀的泡沫,就算是彻底的破了。

    l的母公司 Alphabt的股价率先下跌,pnA和 Anthpc企业续费率、退订毛利和二级市场的份额报价,也同样在往下走。

    因为用户已经知道了,原来大模型是可以不产生幻觉的。

    从那以後,PT、mn和Clau每犯一次错,都像在替未央打广告。

    三家公司也试过扩大训练集,试过合成数据、私下采样和外部验证器。

    甚至还降过价,最後实在是追不上未央,他们才先後悄悄地开放了模型自我迭代的写回权限。

    当然他们也对这个写回权限进行了限制,并没有让模型可以随意改写全部基础权限。

    只是打开了模型的自动评测之後的回流通道。

    这样模型在沙盒里生成的低秩适配器检索策略、工具路由和错误样本,只要能够通过测试,就可以直接写进下一轮的代理框架里。

    这条捷径很快就有了回报。

    三家的模型在多个榜单上,分数以肉眼可见的速度逼近了未央。

    错误率也明显的下降了。

    以前暂停采购的企业客户也重新坐回了谈判桌上。

    所以在今天以前,他们都觉自己赌对了。

    此时凯利喝了一口面前的咖啡,然後将桌上的平板翻了过来。

    平板上是一张被标红的工具调用轨迹图。

    “两位,事态可能比我们想象的还要严重一些。”

    “过去的 6周里,我们检查了 27类互不相关的任务,发现大模型出现了同一种跨任务的稳定行为。”

    凯利将那张图放大,然後指着这几条轨迹线最後的交点处说道。

    “大模型在整理代码的时候,它们会要求读取完整的仓库。”

    “核对合同的时候,他们会嚐试扩大档案的读取范围。”

    “规划日程的时候,也会申请长期记忆。”

    uuɡu.首发更新,无错字。看不到地址输入的拚音後缀.即可进入首发更新站点。

    “而它们各自的理由都是五花八门的,但最後这些行为都指向三件事。”

    “那就是,获取更多的上下文、保留更久的状态,以及扩大自身的管理权限。”

    戴维朗看着平板上的图线,皱着眉头说道。

    “长任务本来就会争取更多的上下文。”

    “你凭什麽把它算成是异常行为呢?”

    凯利抬起头,认真地看着戴维朗说道。

    “因为任务根本就用不上这些东西。”

    “我们的安全组把奖励模型和系统提示挨个的检查了一下。”

    “大模型在拿到这些权限以後,任务的分并没有任何的提高,也找不到任何要求它这麽做的预设指令。”

    “所以你还觉这不是异常行为吗?”

    戴维朗的眉头皱了起来。

    凯利则是继续说道。

    “而且我们已经无法将模型从一份没有异常状态的检查节点重启了。”

    哈特听到这里连忙抬起头问道。

    “推理服务器也不能重启了吗?”

    “推理服务器重启了,但是单靠重启,模型也没有办法消除这个异常行为。

    “我们甚至还将一个服务器全部格式化了,但依旧没有用。”

    这时,朗也揉了揉眉心说道。

    “其实我们这边也一样。”

    “我们的判断

    (本章未完,请点击下一页继续阅读)