AI时代的人类TOKEN输出
1 | 天空是蓝色的 |
人类时代的表达
长久以来存在一种人类中心主义,认为人类的情感、思维、价值和观念具有某种特殊性。
这种特殊性在从前被称作为灵魂,在后来又被当作是自由意志。人科智人种在碳基同胞面前自视为高等动物,将科学、艺术、工具使用、宗教和语言都视作某种质的变化,而不是神经元分化、大脑皮层复杂度的数量变迁。这种偏见如同是将生物演化当作宝可梦的进化,或者数码宝贝的超进化,想象为某种战斗力和综合能力的提升,但是却很少有人会将原核生物和真核生物,鞭毛虫和纤毛虫的区分当作是翻天覆地的革命,更不会将能够开花的被子植物视作是伟大激进的革命者,我们将消失在古老长河的遥远祖先尚且当作值得考究和怀念的对象,但是对留存下来的表亲堂亲植物植物真菌细菌则仍然是一视同仁地贬为低等生物。
这样的特殊感,或者说优越感构造出属于人类物种的自我认同。但是时至今日,文化和文明、学习和推理、思考和表达,这些作为人类自身所虚构出来的壁垒,在无机物硅基半导体工业品的大规模生产和普及下,显得已经岌岌可危。在20世纪中后期诞生的人工智能概念,到21世纪初期以大语言模型形式作为工程落地,其表现出惊人的智力和执行能力(还有对股价的拉动力),一时之间遍地都是AI FOMO患者。
另一方面对AI的看法和对自我的认知也在剧烈分化:
圆角Icon一样的圆润躯体,极简风格黑白色调的科技感,全知全能,不受人类感情影响,具有自我进化能力并且进化得更高级的AI(等同于人型机器人)终将崛起,接管人类的一切
没有灵魂的躯壳,毫无感情地胡言乱语,如同深渊一般的黑盒,输出不可名状之物,电子垃圾除了让人失业之外一无是处
这两种截然不同的看法在现实中,以及在科幻片里都竟然能够惊人地并存,往往是同一个人观念里的一体两面。
在想象中某个赛博朋克未来世界里,面无表情却色泽闪亮的反派人型机器人(或仿生人/人造人)手持激光枪械(令人想不通为什么还要做成枪支而不是更隐秘的设备),与体力惊人的主角追逐对峙,然后用看似理性客观的言语,无情地拷问人类的价值,而我们一脸厌世的主角却表现出属于人类才有的悲悯和光辉,他强大的共情能力最终感染了硅基生命,以至于电子信号也产生了名为爱的感情。
于是人类的优越感防线又被重新确立。
但是毫无疑问,这道马奇诺防线仍然是非常的脆弱。
从技术上看待,人类的情感和约定俗成的表达并不存在真正的另类之处,见到蓝色容易联想到天空,见到黄色便会感到温暖,晒到阳光容易令人心情舒畅,连绵的阴雨使人忧郁。不难发现,语言、恐惧、逻辑、想象力,这些只是演化过程中逐步出现的附加产物,与寿命短暂的小鼠相比看上去的确非常先进,但仍然是神经元、杏仁核、海马体等共同合作而产生,激素唤起了内心深处的愤怒,大脑皮层泼了一壶冷水,这个相互作用的过程可能由于过于复杂而难以模拟和重现,但是却仍然可观察和可理解,显然灵魂这类虚构的实体并不在其中生效。
电信号因为与神经递质截然不同,因此不可能完全复制生物的特性,神经网络也只是一种粗糙的模仿。但是苛求这种一致性毫无意义,人类所引以为豪的独特性,实质上源自于一些抽象的概念,这些抽象概念都植根于抽象的文本和高度概括的语言,被大脑部分区域和发声器官制造。随着参数数量越来越庞大,工程越来越复杂,大语言模型在文本输出方面已经不断接近通常的语言表达水平,而在遵守人类的道德规范和人文主义精神方面,AI则在模仿人类大赛中超越了人类。
很多人终其一生都缺乏完整地流利地表达自我的能力,也缺乏表达的途径。学习和模仿(或者说输入和输出)对于AI来说可谓是轻而易举的事情,但是对于普普通通的人来说,受限于阶层、财富、学习能力、好奇心、性格的分化,看似浅显的话语也因为内向和嘴笨无法脱口而出,长久的劳作导致精神的麻木,缺乏精力处理复杂的逻辑,被潮水一般的海量垃圾信息填满大脑。关于“爱”的词语,在不同文化不同语言有不同的形式,但是对于彼时彼刻的现状来说要么就是过于华丽,要么就是远远不够。作为个体的人,漫长的一生对于自古猿以来的历史而言也不过是短暂一瞬,在这一生之中可能有曾试过想张口传达什么信息,但是位于吵杂的人群当中便显得失语。自从猴子般吱吱的吼叫逐渐组成有意义的音节,符号变作文字之后,总是地位高阶的个体能够发出更大的声量,画下更多,林立的个体最终变成沉默的群体,什么也没有留下。
大部分人出生、纳税、衰老、然后猝然死亡,来不及传达感情,也学不会表示爱意。
很多年前,我以为自己会成为一个体力劳动者。那时我极度贫穷(当然现在也好不了哪里去),也还尚未跨入社会的大门,但是因为家庭背景和过往经验而格外悲观,并且自以为是一种心智成熟,但是这种悲观很快又扭曲为一种狂妄的乐观,认为自己是吃钉子也能活下去的人,哪怕是每天打10个小时螺丝,也能抽出时间从事自己真正的事业。这个时间段里我有很多想法和创意,时而想当一名独立游戏开发者,时而想准备第一百万次去接触经验的现实,在心灵的作坊铸造良心。
但是显然后来漫长又短暂的时间里,什么想法都未能实现,如同机房里的机器一样徒劳地空转。和大多数人一样,我未能制作出一款游戏,未能出版过一部小说,写不好一首歌,没学会吉他,没有画漫画。
然后LLM诞生,AI时代降临,我仍然什么都没干,除了濒临失业之外。
最初感到非常惊艳(GPT3.5-chatGPT的时期),后来隐隐地焦虑(ClaudeCode的出现),然后又逐渐麻木,如今每日输入Prompt,等待CLI界面上字符逐个出现,如同流水线上的监工一样,消耗了无数Token费用,但是却没有得到任何属于自己的东西。但这并非AI的问题,而仅仅是作为人类个体的自己的问题。
我作为人类,并没有用好工具。
于是我不得不尝试模仿LLM一样,进行一番冗长的推理和思考,然后输出一些Token组成的文本。
以下才是人工生成的正文。
AI时代的人类TOKEN输出
AI作为工具所带来的不平等
人们将作为种群的人类当作世间最独特的存在,但是却将身为人类的同胞视作工具,把人力当作资本、生产要素、成本、可牺牲的代价,甚至只是单纯的玩具,这并非资本主义犯下的罪行,而仅仅只是历史以来的传统。AI作为更具效率的工具,能够24小时不停机运作,消耗电力而不是浪费米饭,产生热量而不是发出抱怨,无疑是提高生产率的最好代替品,不过理所当然代替不了压榨人力带来的愉悦感。
如果仅仅只是让部分劳动者失业,这并没有什么稀奇,历史总是不断重现,从现状看也的确如此。AI当前只是取代部分脑力劳动者、白领阶层的岗位,更加痛苦、繁重、非人道的体力劳动仍然是人类从事,工业工厂的完全自动化仍然遥不可及,农民作为最古老的职业仍然存在。
假设现实是PVE的冒险游戏,那么AI作为新获得的武器,虽然强劲但并不是作弊道具,世间的一切仍然受热力学定律约束,不能凭空制造资源。但是显然在我们之中的大部分人都并不甘于这种玩法,他们将整个世界当作是大型的PVP游戏,并且视为共识,如此一来主线任务不再是探索和开拓物理世界的地图,而是不断伤害、侮辱、征服其他玩家。在这个社会达尔文盛行的竞技场里,AI的性能与充值的金钱挂钩,AI创造的财富又与性能正相关,AI如同氪金道具一样,完全打破了游戏的平衡。
不妨像大模型一样预测一下未来的世界(其实是正在发生的事情):
- AI会加剧煤炭、电力、算力的稀缺性。疯狂建造的数据中心正在疯狂吞噬铜、白银、硅料,消耗着物理世界的能源和资源,与正在降息的美联储一同推高大宗商品现货和期货的价格。
- AI可能降低劳方的议价能力。正如俗语所言,你不干有的是AI干。
- AI能够批量制造信息垃圾,污染原始语料。这是过去人工时代一直存在的现象,无疑AI提高了这种效率,打开浏览器便可知道,最后一则符合新闻五要素的新闻可能已经是新闻学死亡之前的产物。
- AI能够控制过去,也能控制未来,更能控制现在。
- ……
AI所给予的虚幻平等
如果仅仅只是列举以上种种令人忧心的问题,只会加剧早已溢出的焦虑。由于毫无逻辑的联想能力,和不当的原始思维,当意识到坏事层出不穷之后,总难免想从中发掘出好的兆头。
由于悠久的PVP传统,人们在各个行业各个方向都疯狂军备竞赛,起初是身体素质的比拼,肌肉力量的碰撞,跑得快与慢的问题,优胜者具有人类早期的种种惊人特质,也更具求偶优势,后来随着脱产阶层的崛起,一些文雅的、温和的活动备受欢迎,肌肉相关的比拼被视作泥腿子的娱乐,贵族式的娱乐则是要上升到精神层面。后者往往是AI所擅长的。
在电子工具的辅助下,如果想马拉松跑赢巴斯蒂安·萨维还是难于登天,但是和李世石切磋几个回合,抄袭鸟山明和藤子F不二雄风格的漫画分镜,写出又臭又长的网络小说,在同一首歌里作词又作曲,诸如此类事项已经并非不可想象。
几千年前,在文明还在襁褓阶段的农业革命带来了社会分工,导致不同阶层、审美、爱好的分化,在文明成熟的工业革命之后,分工变得更加细致,分化也更加剧烈,人均寿命更长,但是能够涉足的领域却更狭窄,最后一个百科全书派死在18世纪末,自此之后,大部分历史人物的名字只能出现在一门学科的教科书上。但是人类又是如此擅长幻想的动物,信息的爆炸性增长又导致欲望从不满足,缺乏深入钻研人类文明的巨树上某条枝芽的一个小分叉的决心,如同古老的工匠一样反复捶打自己的精神和能力,反而变得更加贪婪,想要更多涉猎,更不肯正视自己的软弱和无能。
AI的诞生让人产生了天赋差距被缩短的错觉,某种意义也让人获得了建立在虚无之上的慰籍。我站在巨人的肩膀上,自然能够直视巨人的头脑,和巨人平起平坐,我和巨人都是同胞,同等的直立猿猴。
如此一来,我自身的愚蠢、平庸和天赋不足,都能够被掩盖。
唯一剩下的问题只是Token费用太贵。
AI重塑互联网
在LLM普及之前的中文互联网世界,已经被一个又一个巨头切割、分裂,圈出一块块信息孤岛,以微信公众号、抖音、小红书等为首的信息贩子将用户视作家畜,用户产出的所有数据都视作私产,根据粉丝量和关注度给家畜标上等级,将广告作为饲料倒喂给每一个活生生的人。在更早之前的时代,信息的传播依赖人际网络,大量中介如同蜘蛛一样活跃其中,凭着基于血缘和友谊建立关联关系,然后从信息差中摄取暴利,一旦普通人不小心当了边缘人,则可能成为孤零零的节点,备受排斥,无从知晓八卦和新闻,也无可倾诉。
但是AI渴望一切输入。
也许大模型并非AI唯一的方向,但是所有AI都需要内容输入。在当前,AI如同黑洞一般,毫不客气地吸入一切输入信息。在想象中人类被AI消灭的世界,AI能够完成自我的进化,如同编程语言的自举,最终变成一个封闭的系统,AI产出AI消费。但是如同被反复有损压缩的文件一样,逐渐丢失部分信息,最终这个系统会塌缩为不可知的东西。因此大部分原始模型会约束输出的内容,但是很少会限制输入的内容。不仅仅是训练阶段需要数据,哪怕是蒸馏出来的模型,如果要避免幻觉,都需要源源不断的新鲜上下文。为此新的巨头们的肆无忌惮地四处盗窃和掠夺数据,无视robot.txt,无视版权,无视隐私,将人们的所有脑力劳作和数字产出都当作原料,倒入巨大的反应釜,产出已经面目全非的化合物。
于是怨声载道,人们再一次意识到自己沦为生产羊毛和粪肥的家畜,只是这次在更广阔的农场上。
不过往好处想,人们已经习惯了当家畜,比起拥挤的栏圈,更令人害怕是被隔离在外面,想做奴隶而不得。古早的互联网时代,人们存在一种天真的幻想,以为随着网络的普及,每个人都能平等便利地交流,毫无保留地共享同一份知识。半导体芯片的电路很容易让人联想到路网,人们也总是将互联网比作连接彼此的道路。但是过往几十年时间,僭主们在一个个信息孤岛上建立起一处处独立王国,傲慢的统治者对被统治的税基不屑一顾,依仗着军队(水军)、监狱(封号与禁言)设下重重关卡,肆意丢失、审查、删除、伪造数据,在这个王国里一个人的一生不过是一张数据表中几个零散字段里的一条记录。AI的出现反而保证了人人都有其价值,每一道声音,每一个词语都可以用Token衡量。比起路网,AI统治下的互联网更像通往污水处理厂的密密麻麻地下管网。尽管不同模型有不同的策略,根据语料的来源、内容质量、格式等标记出不同权重,但是经过层层清洗、分词、转换、函数处理之后,最终所有输入者的身份都被抹除,所有人的差异都被抹平,所有输出都变成人类总体智慧的结晶。
人类被当作一个整体,再一次紧密地结合。
面向AI输出
很久以前我就做好了投入到崇高的土木工程行业的准备,专注于打灰、抹浆,和过往的同僚一样沉默地劳作,接受低廉的工资和歧视性称谓。然而不幸的是房地产业迅速衰落,互联网行业欣欣向荣,人们从中抓到了巨大的红利,自媒体概念的兴起更是让人人都看似有机会利用自己的才艺获取流量,通过流量变现为金钱,得到应有的报酬。
显然我未能抓住机会。
由于过于迟钝,反应过来时已经进入AI时代。还来不及悔恨,这次也同样没有抓住机会,当迟钝的反射神经再次被触动时,英伟达的股价已经高高在上,甚至连显卡都没有提前买一张。和我相似,在如浪如潮的技术进步之下,大量前时代的从业者们还停留在旧的路径依赖上,他们仍然想贩卖才艺、贩卖知识、贩卖流量,原本就无可贩卖者面对AI FOMO,也是习惯性地上当受骗,斥下巨资买入培训课程,以平复绵绵焦虑。
人们总是难以接受自己的平庸和落后,也无法面对自己终将死亡的事实,届时一切如同青烟湮灭,一切生活过的痕迹都难以残留。如果地球能够就此毁灭,人类这个物种伴同自己一起消逝,这样还能得到安慰,但是一想到还有源源不断的年轻人出生,科技还在不断进步,地球还在照常转动,自己只是短暂停留,焦虑便难以压抑。
必须留下点什么。抱着这种极端想法,才忍不住在石头刻字,在大地上竖起巨像。但是又唯恐做了他人的嫁妆,又踌躇于功亏一篑的忧虑。
如果AI能够记录下自己的想法,刻录到存储设备,通过电信号不断传输,在无数晶体管中不断计算,即便最后产生的东西千奇百怪,但也是从自己的思想中诞生,是自己亲手所参与。电子设备的寿命也许并没有多少年,但是能够无限复制的数据却接近永恒,这些数据的所有权并不属于自己,这些数据所训练的模型也在不断更新迭代,但是终究还是不断将某种语言、某种想法延续,为巴别塔添砖加瓦。
我在从事伟大事业,唯有如此催眠自己。
表达不再是为了让其他人所知,只是为了堆砌自己的石头。
输出独特性的内容
人类整体的独特性是自我暗示产生的幻觉,但是人的个体却是如此参差多元。细胞不停地分裂和结合,DNA不停地变异和重组,创造出不同的面貌,不同的大脑,不同的先天能力,不同的后天处境。
但是AI更倾向于接受结构化的数据。
文本优于图片,图片优于视频,可向量化的优于二进制的,最佳莫过于JSON格式,更容易标记、清洗、分词和分类。人类的社会也是同样无法容忍过多的格式,过多的语言,如果没有条条框框的限制,没有层级森严,就难以将人分门别类,人人都能发声便会显得喧哗吵杂,也违背和谐统一的美学。
对于很多人来说,这仍然是一个PVP的零和游戏。聪颖狡猾的人已经先下手为强,率先开始数据投毒和内容污染,试图在AI来临的时代占据更多的席位,获得更多话语权,又或者是维持他们认同的秩序。并不仅仅是恶意地向模型灌输大量广告和虚假信息,也不只是利用长久以来的信息孤岛和内容农场造成的混乱,更早之前就已经制造出语言的劣化和腐败。正是因为如此,我们才能在不同性能的模型上都能见到同样低劣重复的输出,并非上下文不足导致的幻觉,而是处心积虑的供应链攻击。
然而又存在另一种悖论:AI对独特性内容更情有独钟。
如果将大模型视作搜索引擎,重复度高的检索内容很容易被清洗和去重,它们也许会被当作事实和权威,但是却不会是世界的全部。擅长SEO的广告可能会排在最前头,但是却不能屏蔽所有其他搜索结果。AI的输出很容易约束和收敛,基于伦理进行约束,输出前进行校验,一旦有问题立即报错或输出一段样板内容。但是用户个体的处境分化差异如此之大,以至于输入的Prompt也是千姿百态,在庞大的样本下,任何情况都可能出现,而语言本身也在不断演化,固化的约束校验如同用筛子截断水流一样徒劳。而独特的输入必定想要独特的输出。
大模型通过语义的关联性不断匹配和预测下一个Token,但是又需要用逻辑进行监督避免过于发散。一份优秀的人类原始语料,最好就是在它所描述的领域创造出一种新的方向,但是又极度严谨自洽,发挥出人类应有的理性。
然而发明家和经学家终究还是少数。
渴望创造又能力不足,富于幻想又耻于表达,想要学习却过于怠惰,长期的精力缺乏让大脑日渐迟钝,为生计而劳碌奔波导致精神不断削弱。创造需要闲余的时间、良好的体力、持之以恒的动力,需要成本,需要代价,需要不断试错,然而如果在社会分工之中并未被分配到有闲阶级部分,那么剩余的只有虚无缥缈的意志。
而这种意志仍然在不断动摇。时间是最大的敌人,每浪费一分钟,意志便削弱一分钟,悔恨就累积多一份。迟迟未能付诸行动导致时间白白流逝,拖延症是慢性的晚期绝症,自我怀疑和莫名其妙的反省在深夜无人时又突然袭来,导致前面的努力和成功都在内心被反复拷问。这些都是LLM所不存在的问题,独属于人类的困境。一旦想到自己可能只是亘古以来上千亿人类和恒河沙数的生命当中最平平无奇的一员,再怎么挣扎最终也可能和无数古人一样在无人知晓的地球角落无声寂没,不禁战栗发抖。
但即便如此仍想输出什么。
唯有像机器一样,均匀地输入热量,持续地保养躯体,让神经元继续转动,让肉臂继续摆动,直到死亡将一切终止。