第一百八十三章 这不是有戏了吗?

    第一百八十三章 这不是有戏了吗? (第2/3页)

    不对。

    比多七十个人还好。

    多七十个人意味着多七十个人的管理成本、沟通成本、磨合期。

    而智能体不需要开会,不需要团建,不需要一对一沟通,管理成本大大降低了。

    韩路一看向姜亦心,认真地说:「小姜,这个工具的优先级提到最高。你需要什麽资源,直接找苏总要。」

    姜亦心还是第一次见韩总用这种语气说话。

    「好的韩总!」姜亦心顿了一下,补充道:

    「对了,还要多亏陈总新设计的评审流程,我们最近在开发基於大模型的评审工具,除了用BugKiller做bug检测之外,还加入对代码风格和可维护性的建议。」

    听到「陈总」两个字,韩路一恍惚了一下,他还以为是陈博文。

    然後他才意识到,姜亦心指的是陈建业。

    哦,对了,他升技术负责人了。

    韩路一又表扬了姜亦心两句,给小姜夸的都不好意思了才离开。

    他还要去十三楼模型组的地方找赵文渊。

    ……

    「文渊,你说的不太顺利,具体是指什麽?」韩路一问道。

    「韩总,国产适配的事,恐怕不可行。」赵文渊苦着一张脸,开口道。

    「技术上有难度?」韩路一挑了挑眉,已经准备自己开视界上了。

    「不是。」赵文渊叹了口气,「工程量太大了。」

    「CUDA做了十几年的生态,你让我带着模型组这几个人,别说适配生态了,一个算子的迁移都搞不定。」

    韩路一倒是不觉得意外。

    生态要是好做,国内的这些硬体厂商早做完了,哪还有这些问题?

    「拿个例子来看看。」韩路一说。

    赵文渊觉得韩路一有点儿多此一举。

    就算你再能写,也不能让你一个一个写过去啊。

    况且你不是已经在做标注了吗?

    赵文渊没把这些话说出来,乖乖的从代码库里找出了一个算子的代码做例子。

    scaled_dot_product_attention

    这是变形金刚(Transformer)架构中比较重要的一个算子,可以说没有这个就做不了大模型。

    「N卡那边有专门的函数,性能和精度都做过深度优化,我手头连个等价实现都没有。」

    韩路一拉过一个椅子坐在电脑前,接过滑鼠,打开浏览器把相关的CUDA原始码、国产显卡的IR文档、HCCL SDK都打开来。

    赵文渊在旁边看的一愣:

    「韩总,你要干什麽?——你不会是要,自己写吧。」

    韩路一头也没抬:「试一试。」

    试一试?赵文渊心里吐槽,韩总,这可是一个团队几个月的工作量。

    韩路一已经打开视界,把CUDA实现中的几个关键地方都扫了出来,然後把要适配国产显卡的要点总结了一下。

    接着韩路一在赵文渊的电脑上打开了姜亦心的AI智能体编程工具。

    但他没把视界看到的关键信息都输进去。

    他想先看一眼,仅靠模型自己能做到什麽程度。

    他输入了第一段提示词:

    「把这个 CUDA算子翻译成国产卡 IR实现。要求精度误差小於 1e-5,性能不低於 N卡实现的70%。下面三份文档作为上下文。」

    然後把浏览器里的连结地址都打了进去。

    很快AI智能体开始自己分解任务、解决任务,最後汇总。

    三分钟後,第一版结果出来了。性能接近 68%,但精度偏差太大了。

    一个大大的红色FAIL显示在屏幕上。

    赵文渊在旁边松了一口气。

    这才正常嘛。

    他对韩路一说:「韩总你看,这就是我说的难点,做不过来——」

    韩路一没有回应赵文渊。

    他重新打开CUDA的原始码,开了视界。

    普通人看代码,看到的是字符。赵文渊看代码,看到的是逻辑。

    但视界让韩路一看到的是另一层东西,不只是

    (本章未完,请点击下一页继续阅读)