人工智能是否真正能够推理和应用伦理原则,还是仅仅表面上模拟它们,很大程度上取决于哲学研究人员和科技公司之间的合作。
十年前,人工智能革命开始爆发时,社会科学和人文专业的学生常常被建议“学习编程”,以便轻松找到工作。人生变幻莫测;如今,当程序员们焦虑地担心人工智能抢走他们的饭碗时,哲学家们却纷纷加入人工智能公司。
今年早些时候,纽约联邦储备银行公布了一些令人惊讶的数据,显示美国哲学专业毕业生比计算机科学专业毕业生更容易找到工作。具体来说,在2024年(最新数据年份),计算机科学专业毕业生的失业率达到7%,而哲学专业毕业生的失业率仅为5.1%。
尤其值得一提的是,人工智能公司正在积极招募哲学人才。“人工智能公司里的哲学研究人员数量正在增加,”谷歌DeepMind领导人工智能社会影响研究团队的伦理专家伊阿宋·加布里埃尔表示。
Nghiên cứu "hành vi" của AI
Iason Gabriel gia nhập DeepMind từ 10 năm trước, khi đó việc coi AI như một tác nhân có trách nhiệm đạo đức vẫn là điều xa vời. Vào thời điểm đó, ông chủ yếu tập trung vào các vấn đề kỹ thuật như định kiến trong thuật toán. Tuy nhiên, sự xuất hiện của các mô hình ngôn ngữ lớn vào đầu những năm 2020 đã thay đổi hoàn toàn cuộc chơi.

Năm 2024 - năm có dữ liệu thống kê gần nhất, tỷ lệ thất nghiệp của những người học khoa học máy tính lên tới 7%, trong khi con số này ở các cử nhân triết học ở mức 5,1%. Ảnh: University of St. Thomas
Ngày nay, các tác nhân AI đảm nhận công việc gửi email, lên lịch họp, viết mã lập trình - nói cách khác, chúng đang thực sự "hành động" trong thế giới thực. "Hành vi" của chúng không chỉ ảnh hưởng đến người dùng trực tiếp mà còn tác động đến cả những người xung quanh. Đây chính là trọng tâm nghiên cứu hiện tại của Gabriel.
Dù mọi người thường thích thảo luận những chủ đề như AI có ý thức hay siêu trí tuệ không, nhưng thực ra các triết gia trong những công ty AI chủ yếu giải quyết những rủi ro cấp thiết hơn, như những vấn đề về sự công bằng, thông tin sai lệch, nguy cơ bị kẻ xấu lợi dụng hay những sai sót khó lường từ các tác nhân AI.
Cùng với các đồng nghiệp tại DeepMind, Julia Haas - nhà triết học chuyên tìm hiểu về cách thức vận hành của tâm trí - đang tìm cách phân biệt liệu AI thực sự có khả năng suy luận và áp dụng các nguyên tắc đạo đức không hay chỉ là sự mô phỏng hời hợt bên ngoài.
Công việc của cô không liên quan trực tiếp đến các quy trình huấn luyện mô hình chủ lực Gemini của Google hay việc đóng gói nó thành các chatbot cho người dùng. "Tôi cho rằng công việc của mình nằm ở giai đoạn rất sớm trong toàn bộ quy trình phát triển", cô nói.
Định hình "thế giới quan" cho AI
Những giá trị mà triết học mang lại cho quá trình nghiên cứu và phát triển AI thực chất đã có từ thời cổ đại. Tiêu biểu là phương pháp Socrates - do triết gia Hy Lạp cổ đại Plato ghi chép lại. Phương pháp này sử dụng kỹ thuật đặt câu hỏi liên tục để giúp người đối thoại tự phát hiện ra giả định, điểm yếu trong lập luận, mâu thuẫn trong suy nghĩ, nhờ đó đi đến hiểu biết sâu hơn.
Hiện nay, nhiều hệ thống AI có xu hướng "nịnh bợ", chỉ nói những gì người dùng muốn nghe. Tuy nhiên, theo Jörg Noller, chuyên gia về triết học và AI tại Đại học Ludwig Maximilian (Munich, Đức), nếu các mô hình AI được huấn luyện theo phương pháp Socrates, chúng sẽ bớt thói quen chiều lòng người và sẵn sàng đi tìm sự thật hơn.
此外,还有“苏格拉底式的无知”这一概念。柏拉图在其著作《申辩篇》中记载,哲学家苏格拉底曾断言,他的智慧主要在于他对已知事物的认知。将这种谦逊“注入”人工智能模型中,有助于限制过度自信——诺勒称之为“人工智能不成熟”的常见缺陷。
伊阿宋·加布里埃尔认为,应用这些理念有助于最大限度地减少人工智能捏造的信息量。由此,他提出哲学是改进人工智能冗长而复杂的推理过程(也称为“思维链”)的“有力工具”。
将哲学理论、原则和思维过程融入人工智能的设计、训练和评估中,可以影响模型在特定情况下的反应。

马塞洛·巴恰雷利的画作《苏格拉底教导阿尔西比亚德斯》(1776年)。图片来源:维基百科
据美国特拉华大学技术哲学家托马斯·鲍尔斯称,如果你将约翰·洛克的著作输入人工智能法律助手,它往往会强调财产权是政治自由的基础。
如果你不喜欢这种价值体系,开发者可以提供其他选项。IBM 的“Granite”系列产品允许企业定制 AI 输出,使其与自身的理念和价值观保持一致。IBM 负责任人工智能负责人 Francesca Rossi 表示,这项功能可以帮助用户自行决定潜在冲突的哲学价值观之间的平衡,例如个人自主与社会和谐之间的关系。
“教导”人工智能表现友善。
哲学也有助于解决安全这一核心问题。研究人员已经记录了人工智能无数令人担忧的行为,从故意逃避监控到甚至……威胁用户。
为了防止这种情况发生,开发人员正在采用“人工智能宪政主义”的方法,即根据从哲学文本中选取的规则和原则框架来构建人工智能模型,这些规则和原则可以作为伦理或法律规范。
Anthropic是倡导人工智能宪政化方法的公司之一。他们为Claude模型制定的“宪政”融合了众多来源——从哲学家伊曼努尔·康德的思想、苹果公司的服务条款到《世界人权宣言》。Anthropic最新版的人工智能宪政由哲学家阿曼达·阿斯韦尔牵头,于今年1月21日发布。
该公司甚至戏称这份78页的文件是克劳德的“灵魂档案”。阿斯韦尔评论道:“撰写宪法的过程就像实践应用哲学,就像教一个人如何过上体面的生活。”然而,最大的问题是,这些“宪法”从一开始就应该包含哪些规则?哲学研究者目前主要关注两大伦理框架。一是与伊曼努尔·康德相关的义务论。该理论制定了严格的规则,禁止诸如撒谎、胁迫以及将人视为工具等行为,即使这些行为有利于大多数人。
Anthropic公司的人工智能“宪章”包含许多此类基于义务的约束。据鲍尔斯博士称,这些原则有助于人工智能表现得更加一致——这在将机器人部署到家庭或公共场所时是一项重大优势。
其次,还有结果理论。该理论考虑成本和收益,从而得出最终决策。

哲学可以帮助塑造人工智能的世界观。图:Anh Thư
遵循结果主义方法的模型包括 OpenAI 的 ChatGPT 和谷歌的 Gemini。例如,谷歌的 AI 模型的设计核心目标是创造“远大于可预见风险的总体收益”——这是结果主义的典型目标。
结果算法对于自动驾驶汽车软件至关重要。如果事故无法避免,人工智能将被迫选择造成损失最小的碰撞方式。自动驾驶汽车公司 Waymo 的高级工程师 Chris Gerdes 表示,企业通常会采用这种以结果为导向的方法开发驾驶软件。
结果理论对于人工智能武器系统也至关重要。据美国参谋长联席会议人工智能中心(美国武装部队的人工智能研究机构)前主任杰克·沙纳汉称,在作战行动中,军方必须计算如何最大限度地降低平民伤亡的风险。
未解答的伦理问题
人工智能技术仍然存在许多棘手的问题。这正是哲学家们能够发挥作用的地方。
是否存在人工智能可以打破严格职责规则的情况?当后果不明朗时,人工智能应该如何决策?人工智能系统在行动时是否应该考虑动物福利或环境状况?
哲学家兼Nauto(一家为商用车生产人工智能安全系统的公司)首席执行官斯特凡·赫克提出了一个棘手的问题:从伦理角度来看,自动驾驶汽车应该优先拯救年轻行人还是老年人?他预测未来将出现极其复杂的伦理诉讼。毕竟,只要能防止更严重的灾难发生,具有公共影响的算法就允许人工智能造成伤害。
路易斯维尔大学的人工智能理论家罗曼·扬波尔斯基认为,伦理本质上是“历史不稳定的、文化可变的、容易被操纵以达到战略目的的,而且往往只有在事后才能清楚地识别出来”。
哲学家们在为人工智能模型的构建做出贡献的同时,人工智能也在影响着著名大学的哲学课程设置。许多院校现在都开设了人工智能伦理课程,或者计算机科学与哲学交叉学科项目。这甚至被专家誉为年度趋势。
然而,人们对人工智能实验室聘用的哲学研究人员的工作仍存在一定程度的质疑。牛津大学人工智能伦理研究所所长爱德华·哈考特教授表示担忧,这些研究人员在从营利性公司领取薪酬的情况下,是否还能保持完全的客观性和中立性。他认为,科技公司越来越多地让哲学研究人员参与人工智能开发,部分原因是出于自我宣传的目的,目的是让他们的工作和产品在公众眼中显得更加重要和先进。
作者:据《光报》报道
最新消息
旧新闻