第二十三届省哲社奖获奖成果丨《机器伦理的哲学基础、基本特征与实现方法》
发布时间:2026-10-10
|来源:省社科联
浏览:
编者按:2025年12月,第二十三届浙江省哲学社会科学优秀成果奖获奖名单正式公布。本届优秀成果奖共评出马克思主义理论研究优秀成果奖、基础理论研究优秀成果奖、应用对策研究与科普优秀成果奖三大类299项,其中一等奖59项、二等奖180项、青年奖60项。获奖成果紧扣中国式现代化进程重大命题,按照“真”“情”“实”“意”要求,围绕构建中国哲学社会科学自主知识体系主线,立足浙江奋力推进中国特色社会主义共同富裕先行和省域现代化先行伟大实践,聚焦哲学社会科学各领域研究前沿,在推进马克思主义中国化时代化新境界,建设中华民族现代文明,回答中国之问、世界之问、人民之问、时代之问中发出浙江声音,彰显了浙江学人深厚的学术积淀、缜密务实的学术方法和开拓创新的进取精神。
成果

浙江大学廖备水教授所著《机器伦理的哲学基础、基本特征与实现方法》一文,2024年2月由《中国社会科学》发表,获“第二十三届浙江省哲学社会科学优秀成果奖”一等奖(基础理论研究类)。
简介
随着人工智能系统自主决策能力的不断提升,如何使智能体的决策具备充分的伦理考量,已成为人工智能健康发展面临的重要挑战。本成果聚焦人工智能自主决策带来的伦理问题,系统探讨机器伦理的理论框架与实践路径,旨在将人类伦理价值观和道德规范嵌入人工智能系统,使其具备伦理对齐能力。成果充分吸收现有理论研究成果,对机器伦理的哲学基础、基本特征与实现方法进行历史的、逻辑的和现实的思考与阐发:揭示机器伦理兴起的理论源泉、技术背景与现实需求,在系统分析义务论、功利论、美德论等多元伦理学理论的基础上,结构化地论证机器伦理的理论架构;以机器的弱主体决策性为逻辑起点,将社会平衡性、文化差异性与人机交互性之间的张力视为逻辑主线,将实现伦理对齐视为机器伦理的逻辑归宿;以人类伦理学理论为指针,剖析知识驱动、数据驱动及数据知识双驱动的实现路径,并与新一代人工智能治理实践相联系,探索伦理对齐的现实道路,倡导在实践中实现机器伦理理想性与现实性的有机统一。
该成果具有较高的学术价值,其学术贡献主要有:第一,提出并论证机器伦理的“弱主体性”特征,具有重要的本体论意义。在传统伦理学中,道德主体通常是具有自由意志、体验能力和责任承担能力的人。然而,当前智能机器尚不具备现实主义意义上的主体性和体验性,其决策本质是基于数据、规则和算法的计算过程,而非自由意志的自主表达,因而无法像人一样承担主体责任。成果从哲学层面深入指出,机器只具有“工具主义”意义上的意向性,并不具有真正的体验性。由此提出的“弱主体性”概念,厘清了机器与人类在伦理责任上的本质差异,为人工智能伦理研究奠定了本体论基础,也为回应“机器能否成为伦理主体”这一核心问题提供了清晰的理论方案。成果在理论层面系统界定了机器伦理的哲学定位,明确了其与人类伦理之间的根本差异,为后续研究奠定了坚实基础。第二,提出并论证机器伦理实现方法具有科学体系意义。成果围绕机器伦理的四项基本特征,即弱主体决策性、社会平衡性、文化差异性和人机交互性,确立了具有普遍意义的价值规范和伦理对齐框架,为认识和推进人工智能伦理治理提供了方法论支撑。成果突破单一学科局限,综合逻辑学、心理学和计算机科学等多学科资源,构建了多维度、可操作的伦理对齐技术体系:知识驱动方法通过形式化规范、论辩框架和可废止规则推理实现显性伦理对齐;数据驱动方法依托案例学习、大语言模型和人类偏好学习捕捉隐性伦理判断;数据知识双驱动方法则融合规则推理与数据学习的优势,以提升系统在复杂情境中的适应能力和可解释性。这一方法体系不仅为评价人工智能技术发展是否合乎伦理提供了相对客观的尺度与标准,也为理解和把握人机和谐共生的实现路径提供了理论支撑。
该成果产生了较好的社会影响:论文被《中国社会科学文摘》《高等学校文科学术文摘》转载,并被人大复印报刊资料全文转载。相关论点被《2024年哲学研究发展报告》摘编,并由俄语期刊《Technologos》2025年第1期转载。论文发表两年来已被引用22次,相关话题和观点入选“2024年度中国十大学术热点”。
作者简介
廖备水,浙江大学哲学学院教授,浙江大学逻辑与认知研究所所长,博士生导师。主要从事逻辑学、知识表示与推理、论辩理论、人工智能伦理与法律人工智能等领域研究。