第二百二十六章 幽灵设备

    视界是什麽黑科技这不好说。

    但是电脑是人发明制造出来的,所有的操作都是有迹可循的。

    韩路一没有再用视界操作,而是回到了自己习惯的操作方式,握住滑鼠,在浏览器里搜索了一下资料。

    然後打开终端,输入了以下命令。

    "$ cat /proc/bus/input/devices"

    输出了一长串,包括所有的已连接设备,韩路一逐一看过去,没有什麽异常,然後他开了一个监听进程,接着用视界操作着打开了一个新建文档,并在里面又打了一行「HelloWorld」。

    在监听进程的输出里可以看到,每一次操作都有一个未知设备以极短的时间连接到电脑上,触发了一个系统输入,然後又断开连接。

    就像是有一个设备在内核驱动的层面发送了信号,绕开了需要持久设备状态的验证。

    韩路一不是硬体专家,但调查到这个地步,他已经可以确定视界的操作恐怕很难在现实层面追踪到了。

    就像是一个幽灵设备。

    他的这一番调查,不仅是想满足自己的好奇心。

    确认视界的操作不会在外部留下可追踪的痕迹,这件事本身就很重要。

    当然,这台是他自己的电脑,本身又是解锁的状态,可以说是基本不设防。但是他刚才在实验的过程中也没有使用过电脑的开机密码。

    视界的新能力对有防护能力的电子设备能操作到什麽程度,还有待进一步测试。

    但是至少,有了这个新能力,韩路一就可以把标注的速度提上去了。

    视界扫描语料,生成标注,虽然耗费精力比较快,但基本上是秒出。

    之前的瓶颈是韩路一的输出速度。

    打字、语音输入,无论是哪种,对几万条甚至几十万条数据来说,都太慢了。

    新的能力则让韩路一本人变成了一个可以向外输出的电脑。

    他看了一下精力值,刚才的一番操作大概掉了50点,和分析语料比起来差不多。

    1000点精力值全用完,差不多可以输出一万条数据。

    花不了几分钟。

    而精力值本身会缓慢恢复,睡一晚还能回满。

    本来受限的英文标注数据一下就不再是问题了。

    赵文渊最近对英文标注催的紧,韩路一快速地生成了七千多条标注,加上他自己之前标注的一些,凑齐了一万条,传到了公司内的加密云盘里。

    在楼上工位上的赵文渊,看到有新的上传提示,停下手头的工作,快速浏览了一下内容。

    不错,这些英文标注的水准,不比之前中文标注的低。

    他满意地点点头,没有和韩路一联系确认一下的意思。

    他已经习惯了。

    老爷爷果然有办法,只要开口,就能拿到需要的资源。

    下一次再要点儿什麽呢?

    鼎盛集团总部,48层的大会议室。

    林绍峰走进来的时候,会议室已经坐了不少人了。

    技术线、产品线、市场线、法务线、公关线,还有集团战略投资部的人,全都到了。

    这在鼎盛内部并不常见。

    鼎盛是巨头,不是创业公司。

    巨头的好处是资源多,但坏处是层级也多。大部分项目推进到一定阶段,都要经过一层又一层的汇报,推进速度极慢。

    但今天不一样。今天坐在会议室主位上的,是鼎盛集团的董事长吕云。

    他只是列席参会,会议进程由CE0郑晓波主持。

    但吕云出现在这里,已经足够体现这个会议的级别了。

    今天这个会,是要出结果的。

    林绍峰就是今天的主汇报人,他把笔记本接到会议室的大屏上,屏幕亮起。

    幻灯片上有一个大标题——坤元。

    底下是一行英文副标题—KunYuan。

    郑晓波看着屏幕,脸上没什麽表情。

    AI赛道上,鼎盛在国内的几家大厂里不算落後,乾元的发布也很成功。但是现在的问题是,还没有能在国际上拿得出手的产品。

    在AI这件事上,吕云有他自己的判断,也和郑晓波分享过。他觉得这是一个赢家通吃的游戏,为了不被吃掉,鼎盛必须得成为赢家。鼎盛的对手不在国内,而在国际。

    这也让郑晓波知道,吕云对他现在的成绩还不满意。

    他心里也急,在AI赛道上做出成绩,是董事会,也就是吕云对他的要求。

    但他知道,急也没用,事情得一步一步做。

    坤元就是第一步。

    昨天训练的结果出来,几个公开测试集都跑过了,还没有去网上发布结果,林绍峰已经私底下把结果向郑晓波汇报过了。

    今天的这个会议,是演示,是告知,不是决策讨论。

    「吕总,郑总。」林绍峰开门见山,「坤元的内部测评已经完成了,从综合能力来看,坤元1.0的各项能力已经进入全球第一梯队。」

    开篇先强调了一下成绩,林绍峰环顾了一下观众,重点注意了吕云的反应,但是没看出什麽来。

    他按了一下手中的翻页器,大屏幕上出现了一张综合数据。

    数学,代码,多语言理解,长上下文,逻辑推理,知识问答,意图理解。

    每一项都有分数、排名、对标模型。

    「如果只看通用能力,坤元1.0目前落後於GPT最新一代旗舰模型,但是差距已经不大。」林绍峰说道:「和Gemini、水星的最新版本相比,我们在部分项目上互有胜负。尤其是在中文任务、企业场景、复杂指令遵循这几个维度,坤元的表现非常突出。」

    然後他切到下一页。

    这一页的标题是:中文意图理解专项评测。

    屏幕上是一组更夸张的数据。

    坤元1.0在中文复杂需求理解、隐含条件识别、业务流程补全、用户真实意图判断这些项目上,全面高於所有对标模型。而且不是小幅领先,而是跨越式的高。

    断层碾压。

    会议室里响起了低声的讨论声。

    大部分人都知道这个结果意味着什麽。

    大模型研究在国内是後发,如果能做出第一个在单项领域全世界登顶的大模型,对鼎盛的行业地位都有重大意义。

    林绍峰紧接着讲了具体的测评标准,包括公开测试集、内部自建题库、第三方公开任务集,和企业真实场景脱敏数据。

    「国产大模型最大的问题,是大家做的比较像。正落到业务场景里,经常听不懂人话。用户说一句帮我弄一下这个」,模型不知道这个」是什麽,用户说老板要看」,模型不知道重点应该放在风险、结果还是汇报口径上。」

    会议室里不少业务线负责人都点了点头,他们对这些场景都深有体会。

    大部分大模型演示的时候看起来很强,真正接入业务系统,就像一个刚毕业的实习生。

    做业务的能力比写代码的能力差多了。

    这也不怪大模型,代码本身是可验证的,对就是对,错就是错,做业务可不是这样,模糊的地方很多。

    到了问答环节,市场部的负责人先站出来说话了。

    他知道今天会议的自的,就是为坤元的发布定计划。

    刚才林绍峰展示的数据很好看,拿出去说是一回事,但是真的有几斤几两,不好说。

    他还得先弄清楚坤元的真实水平,才好制定相应的计划。

    「林总,这个成绩很惊人。我不是不信任测评,但是咱们能不能搞个演示,看看真实场景的效果?」

    市场部负责人的这句话一问出来,吕云的目光就转了过来。

    >(记住本站网址,Www.WX52.info,方便下次阅读,或且百度输入“ xs52 ”,就能进入本站)
这篇小说不错 推荐
先看到这里 书签
找个写完的看看 全本
(快捷键:←) 上一章   回目录   下一章 (快捷键:→)
如果您认为首富从看见信息面板开始不错,请把《首富从看见信息面板开始》加入书架,以方便以后跟进首富从看见信息面板开始最新章节的连载更新