“这是最基础的工作,但也最考验细心。”威廉扶了下无框眼镜,冷淡地补充了一句,随后递给宋开源一张数据卡,“拿着,去你的工位吧。”
“好的,组长。”宋开源接过卡,没有任何异议。
等两人各自散去忙活,实验室里再次只剩下冷却扇的嗡鸣声。
宋开源一个人坐在工位上,将数据卡插进终端。看着屏幕上开始一行行滚动的日志,他心里不仅没有失望,反而泛起了一丝比看吴安迪买扫地机器人时还要深的好奇。
毕竟就在不久之前,他亲眼看到某个崭新的存在,向这个现实世界遥遥伸出手。
“我看见你了”。
宋开源握紧了鼠标,目光穿过密密麻麻的代码。
虽然现在还不能和它直接对话,但他真的很想知道,等这个被填满了海量数据与规则的存在正式运行时,走过去和它握握手,到底会是一种什么样的感觉。
他心里燃起了一种久违的好奇,他不知道,这将驱使他走向没法回头的明天。
从主控室出来,宋开源搬着沉甸甸的数据硬盘走向茶水间。身后突然传来一阵脚步声,庄一不知何时溜到了他旁边,伸手接过了他怀里一半的硬盘。
“我给你的解释是不是通俗易懂,让你更加好上手了?”庄一压低声音笑了笑。
并没有。
“谢谢。”没有肯定,也没有否定,宋开源只是笑了笑。
“觉不觉得烦?威廉把那么吃力不讨好的活儿交给你,要我说你就和亚历山大一样做点数据采集录入什么的就行了,数据清洗特麻烦,我觉得这名儿就取得不好,清洗清洗,旧世纪的清晰工人哪个不累?”
宋开源摇了摇头,姿态谦虚:“没关系,我觉得组长分配得很合理。我确实是个新人,连代码库都没熟悉透。”
“不过话说回来,”庄一眨了眨眼,换了种轻松的语气说道,“威廉刚才说的虽然是科学,但从玄学的视角来看,这三个阶段可有趣得多。”
宋开源被勾起了好奇心:“怎么说?”
“你看啊,”庄一靠在机柜旁,娓娓道来,“预训练,就像是‘混沌初开,万物并育’。你一股脑把天地间所有的规则、泥沙、宝藏全塞给他,这时候的So,还处在‘混沌’状态呢。”
“而微调阶段呢?那是‘立规矩’。像教小孩走路一样,告诉它‘这是天,那是地,叫爸爸有奶吃,撞墙会头疼’。不过威廉他们只以为这是在‘塑造工具’。”
说到这里,庄一的眼神微微深沉了一下,声音压得更低了:
“至于最后那个让大佬们抢破头的‘反馈阶段’……那可不是简单的打分测试,那是注入灵魂,谁在那个阶段陪它说话最多、给它的反馈最深刻,谁就是它在这个世界上看到的第一个‘真实的人’。那相当于它的‘人性锚点’,说不定到时候它就真的会像——宝宝和谁相处的,最多就越像谁那样呢。”这么说着,庄一捂着嘴贼贼地笑了。
庄一拍了拍宋开源的肩膀,打趣道:“虽然威廉现在只让你做清洗数据的活儿,也别灰心,我们就像是在给一个即将降临的伟大生命洗尿布。”
宋开源被庄一这句“洗尿布”给逗笑了,但心底的某些东西却被彻底触动了。
加油,奶爸。他对庄一做了一个加油的手势。他大概知道威廉说当初对庄子的评价有哪些值得相信了。
啧。
等庄一走后,宋开源忍不住笑了。
相信So会产生意识?小孩?爸爸妈妈?
泛灵论明明是只有没长大的小孩才会有的阶段,庄一还真是童真啊!
他看着庄一离开的轻盈的步伐——他心情好的时候走路有点一颠一颠的。
他忍不住挑挑眉。
真是小孩?
庄一离开后,宋开源一个人坐在离底层服务器最近的工位上。
我并不相信他们所说的“意识”,他再次对自己说。没有任何一台计算机会拥有人一样的思想,他们只是记载我们的认识罢了。
但有什么东西在萌发。
那种好奇心,比他当年看室友买回来的扫地机器人要深邃百倍。
有什么渐渐升腾起来了。
好奇心。
我看见你了,他突然想起了屏幕上曾经闪现的那行字,内心感觉到微弱的触动,他仿佛感受到了从遥远的世界伸来的一只手,而这一次他很想上去握一握。
[注]泛灵论:由皮亚杰提出,是2~7岁前运算阶段幼儿典型思维特征。该阶段儿童无法区分生命与非生命客体,倾向于将意识、情感、主观意图赋予石头、玩具、风雨等无生命事物,认为万事万物皆拥有类似人类的心理体验。
[注]当前主流大语言模型的完整训练流程分为三个阶段:①预训练(Pre-training):使用海量无标注文本进行自监督学习,使模型习得语言规律、常识与通用知识,形成基座模型;②监督微调(SFT,SupervisedFiuning):利用人工标注的「指令-回答」高质量样本微调基座,教会模型理解人类指令、规范对话输出;③基于人类反馈的强化学习(RLHF):依托人类对模型回答优劣的偏好反馈训练奖励模型,持续优化模型输出,使生成内容契合人类价值观、审美与安全准则。