生成式人工智能基础 课件 第14章 伦理与法律考量_第1页
生成式人工智能基础 课件 第14章 伦理与法律考量_第2页
生成式人工智能基础 课件 第14章 伦理与法律考量_第3页
生成式人工智能基础 课件 第14章 伦理与法律考量_第4页
生成式人工智能基础 课件 第14章 伦理与法律考量_第5页
已阅读5页,还剩73页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第1版·微课版生成式人工智能基础第14章伦理与法律考量随着AI不断取得突破,LLM时代到来,一些潜在的隐患和道德伦理问题也逐步显现出来。例如,AI在安全、隐私等方面存在一定风险隐患:“换脸”技术有可能侵犯个人隐私,信息采集不当会带来数据泄露,算法漏洞加剧则认知偏见……这说明,AI及其LLM不单具有技术属性,还具有明显的社会属性。唯有综合考虑经济、社会和环境等因素,才能更好地应对AI技术带来的机遇和挑战,推动其健康发展。第14章伦理与法律考量AI治理带来很多伦理和法律课题,如何打造“负责任的AI”正变得愈发迫切和关键。必须加强AI发展的潜在风险研判和防范,规范AI的发展,确保AI安全、可靠、可控。要建立健全保障AI健康发展的法律法规、制度体系、伦理道德。致力于依照“以人为本”的伦理原则推进AI的发展,应该将“社会责任AI”作为一个重要的研究方向。只有正确处理好人和机器的关系,才能更好地走向“人机混合”智能时代。第14章伦理与法律考量01AIGC面临的伦理挑战02数据隐私保护对策03AI伦理原则04LLM的知识产权保护目录/CONTENTSPART01AIGC面临的伦理挑战华裔AI科学家李飞飞表示,现在迫切需要让伦理成为AI研究与发展的根本组成部分。显然,我们比历史上任何时候都更加需要注重技术与伦理的平衡。因为一方面技术意味着速度和效率,应发挥好技术的无限潜力,善用技术追求效率,创造社会和经济效益。另一方面,人性意味着深度和价值,要追求人性,维护人类价值和自我实现,避免技术发展和应用突破人类伦理底线。只有保持警醒和敬畏,在以效率为准绳的“技术算法”和以伦理为准绳的“人性算法”之间实现平衡,才能确保“科技向善”。14.1AIGC面临的伦理挑战AIGC技术的发展和应用带来了显著的创新和便利,但同时也伴随着一系列复杂的伦理挑战。以下是AIGC所面临的几个主要伦理问题:(1)工作与就业冲击:AIGC技术的广泛应用可能导致某些行业和职业的人力需求减少,引发对失业和社会不平等的担忧。人们担心AI可能会取代人类在内容创作、数据分析、客户服务等多个领域的工作岗位。(2)原创性与版权争议:由AI生成的内容在版权归属、原创性认定上存在法律空白和争议。谁应该为AI创作的作品享有版权?是开发AI的公司、操作AI的用户,还是AI本身?这挑战了现有的知识产权体系。14.1AIGC面临的伦理挑战(3)真实性与信任危机:AIGC技术可以生成高度逼真的文本、图像、音频和视频,这可能被用于制造假新闻、深度伪造,进而影响公众舆论、误导群众,损害媒体公信力和个人隐私。(4)责任归属:当AIGC导致负面影响,如错误信息传播、侵犯个人名誉权时,责任应该如何界定?是开发者、使用者,还是维护者?这需要明确的法律框架和道德准则。14.1AIGC面临的伦理挑战(5)人类智能与尊严:随着AIGC技术的智能化水平提升,可能引发对人类智能价值和地位的讨论。人们担忧过度依赖AI会削弱人类创造力、批判性思维能力,甚至影响人类自我认同。(6)算法偏见与公平性:AIGC系统基于训练数据生成内容,如果训练数据含有偏见,生成的内容也可能带有偏见,这会加剧社会不公,比如性别、种族歧视等问题。14.1AIGC面临的伦理挑战(7)隐私保护:AIGC在处理个人数据时,如何确保数据的安全和隐私,避免未经许可的信息泄露或滥用,是另一个重要伦理议题。(8)社会实验伦理:利用AIGC进行的社会实验,尤其是当涉及模拟人类行为、心理状态时,需要严格遵守伦理规范,防止对参与者造成伤害或侵犯其权利。14.1AIGC面临的伦理挑战解决这些伦理挑战需要跨学科合作,包括技术开发者、法律专家、伦理学家、社会科学家以及政策制定者的共同努力,通过制定合理的政策、法规和技术标准,引导AIGC技术健康发展,确保技术进步的同时保护人类价值和社会福祉。14.1AIGC面临的伦理挑战PART02数据隐私保护对策数据产业面临的伦理问题包括数据主权和数据权问题、隐私权和自主权的侵犯问题、数据利用失衡问题,这些问题影响了大数据的生产、采集、存储、交易流转和开发使用全过程。相较于传统隐私和互联网发展初期,大数据技术的广泛运用使隐私的概念和范围发生了很大的变化,呈现数据化、价值化的新特点。数据隐私保护伦理问题的解决需要从责任伦理的角度出发,关注技术带来的风险,倡导多元参与主体的共同努力,在遵守隐私保护伦理准则的基础上,加强道德伦理教育和健全道德伦理约束机制。14.2数据隐私保护对策由于跨境数据流动剧增、数据经济价值凸显、个人隐私危机爆发等多方面因素,数据主权和数据权已成为数据和AI产业发展遭遇的关键问题。数据的跨境流动是不可避免的,但这也给国家安全带来了威胁,数据的主权问题由此产生。数据主权是指国家对其政权管辖地域内的数据享有生成、传播、管理、控制和利用的权力。数据主权是国家主权在信息化、数字化和全球化发展趋势下新的表现形式,是各国在大数据时代维护国家主权和独立,反对数据垄断和霸权主义的必然要求,是国家安全的保障。14.2.1数据主权和数据权问题数据权包括机构数据权和个人数据权。机构数据权是企业和其他机构对个人数据的采集权和使用权,是企业的核心竞争力。个人数据权是指个人拥有对自身数据的控制权,以保护自身隐私信息不受侵犯的权利,也是个人的基本权利。个人在互联网上产生了大量的数据,这些数据与个人的隐私密切相关,个人对这些数据拥有财产权。14.2.1数据主权和数据权问题数据财产权是数据主权和数据权的核心内容。以大数据为主的信息技术赋予了数据以财产属性,数据财产是指将数据符号固定于介质之上,具有一定的价值,能够为人们所感知和利用的一种新型财产。数据财产包含形式要素和实质要素两个部分,数据符号所依附的介质为其形式要素,数据财产所承载的有价值的信息为其实质要素。2001年的世界经济论坛将个人数据指定为“新资产类别”,数据成为一种资产,并且像商品一样被交易。14.2.1数据主权和数据权问题数据利用的失衡主要体现在两个方面。(1)数据的利用率较低。随着网络应用的发展,每天都有海量的数据产生,全球数据规模呈指数级增长,但是,一项针对大型企业的调研结果显示,企业大数据的利用率仅在12%左右。就掌握大量数据的政府而言,其数据的利用率更低。14.2.2数据利用失衡问题(2)数字鸿沟现象日益显著。数字鸿沟束缚数据流通,导致数据利用水平较低。大数据的“政用”“民用”和“工用”相对于大数据在商用领域的发展,无论技术、人才还是数据规模都有巨大差距。现阶段大数据应用较为成熟的行业是电商、电信和金融领域,医疗、能源、教育等领域则处于起步阶段。由于大数据在商用领域产生巨大利益,数据资源、社会资源、人才资源均向其倾斜,涉及经济利益较弱的领域,市场占比少。在商用领域内,优势的行业或优势的企业也往往占据了大量的大数据资源。14.2.2数据利用失衡问题大数据对于改善民生、辅助政府决策、提升工业信息化水平、推动社会进步可以起到巨大的作用,因此大数据的发展应该更加均衡,这也符合国家大数据战略中服务经济社会发展和人民生活改善的方向。14.2.2数据利用失衡问题构建隐私保护伦理的准则包括:(1)权利与义务对等。数据生产者作为数据生命周期中的坚实基础,既有为大数据技术发展提供数据源和保护个体隐私的义务,又有享受大数据技术带来便利与利益的权利。数据搜集者作为数据生产周期的中间者,他们既可以享有在网络公共空间中搜集数据以得到利益的权利,又负有在数据搜集阶段保护用户隐私的义务。数据使用者作为整个数据生命周期中利益链条上游部分的主体,他们在享有了丰厚利润的同时,也负有推进整个社会发展、造福人类和保护个人隐私的义务。14.2.3构建隐私保护伦理准则(2)自由与监管适度。主体的意志自由正在因严密的监控和隐私泄露所导致的个性化预测而受到禁锢。而个人只有在具有规则的社会中才能谈自主、自治和自由。因此,在解决隐私保护的伦理问题时,构建一定的规则与秩序,在维护社会安全的前提下,给予公众适度的自由,也是隐私保护伦理准则所必须关注的重点。所以要平衡监管与自由两边的砝码,让政府与企业更注重个人隐私的保护,个人加强保护隐私的能力,防止沉迷于网络,努力做到在保持社会良好发展的同时,也不忽视公众对个人自由的诉求。14.2.3构建隐私保护伦理准则(3)诚信与公正统一。因丰厚经济利润的刺激和社交活动在虚拟空间的无限延展,使得互联网用户逐渐丧失对基本准则诚信的遵守。例如,利用黑客技术窃取用户隐私信息,通过不道德商业行为攫取更多利益等。在社会范围内建立诚信体系,营造诚信氛围,不仅有利于隐私保护伦理准则的构建,更是对个人行为、企业发展、政府建设的内在要求。14.2.3构建隐私保护伦理准则(4)创新与责任一致。在构建隐私保护的伦理准则时,可以引入“负责任创新”理念,对大数据技术的创新和设计过程进行全面的综合考量与评估,使大数据技术的相关信息能被公众所理解,真正将大数据技术的“创新”与“负责任”相结合,以一种开放、包容、互动的态度来看待技术的良性发展。14.2.3构建隐私保护伦理准则健全隐私保护的道德伦理约束机制,包括:(1)建立完善的隐私保护道德自律机制。个人自觉保护隐私,首先应该清楚意识到个人信息安全的重要性,做到重视自我隐私,从源头切断个人信息泄露的可能。政府、组织和企业可以通过不断创新与完善隐私保护技术的方式让所有数据行业从业者都认识到隐私保护的重要性,并在数据使用中自觉采取隐私保护技术,以免信息泄露。企业还可以通过建立行业自律公约的方式来规范自我道德行为,以统一共识的达成来约束自身行为。14.2.4健全道德伦理约束机制(2)强化社会监督与道德评价功能。建立由多主体参与的监督体系来实时监控、预防侵犯隐私行为的发生,这在公共事务上体现为一种社会合力,代表着社会生活中一部分人的发声,具有较强的制约力和规范力,是完善隐私保护道德伦理约束机制的重要一步。其次,健全道德伦理约束机制还可以发挥道德的评价功能,让道德舆论的评价来调整社会关系,规范人们的行为。在隐私保护伦理的建设过程中,运用社会伦理的道德评价,可以强化人们的道德意志,增强他们遵守道德规范的主动性与自觉性,将外在的道德规范转化为人们的自我道德观念和道德行为准则。14.2.4健全道德伦理约束机制PART03AI伦理原则AI发展不仅仅是一场席卷全球的科技革命,也是一场对人类文明带来前所未有深远影响的社会伦理实验。在应用层面,AI已经开始用于解决社会问题,各种服务机器人、辅助机器人、陪伴机器人、教育机器人等社会机器人和智能应用软件应运而生,各种伦理问题随之产生。机器人伦理与人因工程相关,涉及人体工程学、生物学和人机交互,需要以人为中心的机器智能设计。14.3AI伦理原则随着推理、社会机器人进入家庭,如何保护隐私、满足个性都要以人为中心而不是以机器为中心设计。过度依赖社会机器人将带来一系列的家庭伦理问题。为了避免AI以机器为中心,需要法律和伦理研究参与其中,而相关伦理与哲学研究也要对技术有必要的了解。14.3AI伦理原则需要制定AI的职业伦理准则,来达到下列目标:(1)为防止AI技术的滥用设立红线;(2)提高职业人员的责任心和职业道德水准;(3)确保算法系统的安全可靠;(4)使算法系统的可解释性成为未来引导设计的一个基本方向;(5)使伦理准则成为AI从业者的工作基础;(6)提升职业人员的职业抱负和理想。14.3.1职业伦理准则的目标AI的职业伦理准则至少应包括下列几个方面:(1)确保AI更好地造福于社会;(2)在强化人类中心主义的同时,达到走出人类中心主义的目标,形成双向互进关系;(3)避免AI对人类造成任何伤害;(4)确保AI体位于人类可控范围之内;(5)提升AI的可信性;14.3.1职业伦理准则的目标(6)确保AI的可问责性和透明性;(7)维护公平;(8)尊重隐私、谨慎应用;(9)提高职业技能与提升道德修养并行发展。14.3.1职业伦理准则的目标2018年7月11日,中国AI产业创新发展联盟发布了《AI创新发展道德伦理宣言》(简称《宣言》)。《宣言》除了序言之外,一共有六个部分,分别是AI系统,AI与人类的关系,AI与具体接触人员的道德伦理要求,以及AI的应用和未来发展的方向,最后是附则。发布“AI创新发展道德伦理宣言”,是为了宣扬涉及AI创新、应用和发展的基本准则,以期无论何种身份的人都能经常铭记本宣言精神,理解并尊重发展AI的初衷,使其传达的价值与理念得到普遍认可与遵行。14.3.2创新发展道德伦理宣言《宣言》指出:(1)鉴于全人类固有道德、伦理、尊严及人格之权利,创新、应用和发展AI技术当以此为根本基础;(2)鉴于人类社会发展的最高阶段为人类解放和人的自由全面发展,AI技术研发当以此为最终依归,进而促进全人类福祉;(3)鉴于AI技术对人类社会既有观念、秩序和自由意志的挑战巨大,且发展前景充满未知,对AI技术的创新应当设置倡导性与禁止性的规则,这些规则本身应当凝聚不同文明背景下人群的基本价值共识;14.3.2创新发展道德伦理宣言(4)鉴于AI技术具有把人类从繁重体力和脑力劳动束缚中解放的潜力,纵然未来的探索道路上出现曲折与反复,也不应停止AI创新发展造福人类的步伐。14.3.2创新发展道德伦理宣言建设AI系统,要做到:(1)AI系统基础数据应当秉持公平性与客观性,摒弃带有偏见的数据和算法,以杜绝可能的歧视性结果。(2)AI系统的数据采集和使用应当尊重隐私权等一系列人格权利,以维护权利所承载的人格利益。(3)AI系统应当有相应的技术风险评估机制,保持对潜在危险的前瞻性控制能力。(4)AI系统所具有的自主意识程度应当受到科学技术水平和道德、伦理、法律等人文价值的共同评价。14.3.2创新发展道德伦理宣言为明确AI与人类的关系,《宣言》指出:(1)AI的发展应当始终以造福人类为宗旨。牢记这一宗旨,是防止AI的巨大优势转为人类生存发展巨大威胁的关键所在。(2)无论AI的自主意识能力进化到何种阶段,都不能改变其由人类创造的事实。不能将AI的自主意识等同于人类特有的自由意志,模糊这两者之间的差别可能抹杀人类自身特有的人权属性与价值。(3)当AI的设定初衷与人类整体利益或个人合法利益相悖时,AI应当无条件停止或暂停工作进程,以保证人类整体利益的优先性。14.3.2创新发展道德伦理宣言《宣言》指出,AI具体接触人员的道德伦理要求是:(1)AI具体接触人员是指居于主导地位、可以直接操纵或影响AI系统和技术,使之按照预设产生某种具体功效的人员,包括但不限于AI的研发人员和使用者。(2)AI的研发者自身应当具备正确的伦理道德意识,同时将这种意识贯彻于研发全过程,确保其塑造的AI自主意识符合人类社会主流道德伦理要求。14.3.2创新发展道德伦理宣言(3)AI产品的使用者应当遵循产品的既有使用准则,除非出于改善产品本身性能的目的,否则不得擅自变动、篡改原有的设置,使之背离创新、应用和发展初衷,以致破坏人类文明及社会和谐。(4)AI从业人员可以根据自身经验,阐述其对产品与技术的认识。此种阐述应当本着诚实信用的原则,保持理性与客观,不得诱导公众的盲目热情或故意加剧公众的恐慌情绪。14.3.2创新发展道德伦理宣言针对AI的应用,《宣言》指出:(1)AI发展迅速,但也伴随着各种不确定性。在没有确定完善的技术保障之前,在某些失误成本过于沉重的领域,AI的应用和推广应当审慎而科学。(2)AI可以为决策提供辅助。但是AI本身不能成为决策的主体,特别是国家公共事务领域,AI不能行使国家公权力。14.3.2创新发展道德伦理宣言(3)AI的优势使其在军事领域存在巨大应用潜力。出于对人类整体福祉的考虑,应当本着人道主义精神,克制在进攻端武器运用AI的冲动。(4)AI不应成为侵犯合法权益的工具,任何运用AI从事犯罪活动的行为,都应当受到法律的制裁和道义的谴责。(5)AI的应用可以解放人类在脑力和体力层面的部分束缚,在条件成熟时,应当鼓励AI在相应领域发挥帮助人类自由发展的作用。14.3.2创新发展道德伦理宣言《宣言》指出,当前发展AI的方向主要是:(1)探索产、学、研、用、政、金合作机制,推动AI核心技术创新与产业发展。特别是推动上述各方资源结合,建立长期和深层次的合作机制,针对AI领域的关键核心技术难题开展联合攻关。(2)制定AI产业发展标准,推动AI产业协同发展。推动AI产业从数据规范、应用接口以及性能检测等方面的标准体系制定,为消费者提供更好的服务与体验。14.3.2创新发展道德伦理宣言(3)打造共性技术支撑平台,构建AI产业生态。推动AI领域龙头企业牵头建设平台,为AI在社会生活各个领域的创业创新者提供更好支持。(4)健全AI法律法规体系。通过不断完善AI相关法律法规,在拓展人类AI应用能力的同时,避免AI对社会和谐的冲击,寻求AI技术创新、产业发展与道德伦理的平衡点。AI的发展在深度与广度上都是难以预测的。根据新的发展形势,对本宣言的任何修改都不能违反人类的道德伦理法律准则,不得损害人类的尊严和整体福祉。14.3.2创新发展道德伦理宣言2019年,欧盟AI高级别专家组正式发布了“可信赖的AI伦理准则”。根据准则,可信赖的AI应该是:(1)合法——尊重所有适用的法律法规。(2)合乎伦理——尊重伦理原则和价值观。(3)稳健——既从技术角度考虑,又考虑到其社会环境。14.3.3欧盟可信赖的伦理准则该指南提出了未来AI系统应满足的7大原则,以便被认为是可信的。并给出一份具体的评估清单,旨在协助核实每项要求的适用情况。(1)人类代理和监督:AI不应该践踏人类的自主性。人们不应该被AI系统所操纵或胁迫,应该能够干预或监督软件所做的每一个决定;(2)技术稳健性和安全性:AI应该是安全而准确的,它不应该轻易受到外部攻击(例如对抗性例子)的破坏,并且应该是相当可靠的;(3)隐私和数据管理:AI系统收集的个人数据应该是安全的,并且能够保护个人隐私。它不应该被任何人访问,也不应该轻易被盗;14.3.3欧盟可信赖的伦理准则(4)透明度:用于创建AI系统的数据和算法应该是可访问的,软件所做的决定应该“为人类所理解和追踪”。换句话说,操作者应该能够解释他们的AI系统所做的决定;(5)多样性、无歧视、公平:AI应向所有人提供服务,不分年龄、性别、种族或其他特征。同样,AI系统不应在这些方面有偏见;(6)环境和社会福祉:AI系统应该是可持续的(即它们应该对生态负责),并能“促进积极的社会变革”;(7)问责制:AI系统应该是可审计的,并由现有的企业告密者保护机制覆盖。系统的负面影响应事先得到承认和报告。14.3.3欧盟可信赖的伦理准则这些原则中有些条款的措辞比较抽象,很难从客观意义上进行评估。这些指导方针不具有法律约束力,但可以影响欧盟起草的任何未来立法。欧盟发布的报告还包括了一份被称为“可信赖AI评估列表”,帮助专家们找出AI软件中的任何潜在弱点或危险。此列表包括以下问题:“你是否验证了系统在意外情况和环境中的行为方式?”以及“你评估了数据集中数据的类型和范围了吗?”此次出台的指导方针“为推动AI的道德和责任制定了全球标准。”14.3.3欧盟可信赖的伦理准则PART04LLM的知识产权保护AI的技术发展与知识产权归属的边界正变得日益模糊。通过大量公开数据进行训练,从而让模型学习具有生成产物的能力,这就是生成式AI的构建方式。这些数据包括文字、画作和代码,模型正是从海量的数据中获得的生成同样产物的能力。随着GAI的快速崛起,在重塑行业、赋能人类工作生活的同时,也引发了版权制度层面的一系列新的挑战。14.4LLM的知识产权保护Midjourney是一款著名和强大的AI绘画工具,它为用户提供了各种创意的绘图功能,可以是文生图或者图生图。图14-1真想知道插画师用用了哪些关键词实现了这幅作品14.4.1LLM的诉讼案例尽管Midjourney面临严重的版权问题,但其创始人大卫·霍尔茨针对AI对创意工作的影响有自己的看法,他强调Midjourney的目标是拓展人类的想象力,帮助用户快速产生创意,为专业用户提供概念设计的支持,而不是取代艺术家。他认为AI技术的发展将促使市场朝着更高质量、更有创意、更多样化和更深度的内容方向发展。AI技术的出现对那些雄心勃勃的艺术家的未来影响仍有待观察,但艺术工作本身是有趣的,AI技术应该服务于让人们自由发展更有回报、更有趣的工作,而不是取代艺术家的创作过程。14.4.1LLM的诉讼案例艺术家是否愿意将作品纳入AI训练模型、是否会对版权问题产生担忧等议题值得深入思考。随着AI技术的发展,可能会对艺术创作带来新的影响和挑战。然而,尊重艺术家的创作意愿,维护版权法律,是保障艺术创作多样性和质量的重要途径。通过合理规范和监管,AI技术可以更好地服务于艺术创作和创作者,实现技术与人文的和谐共生。14.4.1LLM的诉讼案例在艺术创作领域,AI技术作为一种辅助工具,有助于提高创作效率和创意产出,但无法替代艺术家的独特创作能力和灵感。对于艺术家来说,关键在于如何运用和平衡AI技术,创作出更具深度和独特性的作品,从而实现艺术创作与科技创新的有机结合。Midjourney的未来发展方向也需要更多的思考和探讨,以确保AI技术的应用能够更好地服务于艺术创作和创作者,促进艺术的多样性和创新性。14.4.1LLM的诉讼案例(1)“训练”类技术的首次法律诉讼。2022年11月3日和10日,程序员兼律师马修·巴特里克等人向美国加州北区联法院递交了一份集体诉讼起诉书,指控OpenAI和微软使用他们贡献的代码训练AI编程工具Copilot及Codex,要求法院批准90亿美元(约649亿人民币)的法定损害赔偿金。14.4.1LLM的诉讼案例根据集体诉讼文件,每当Copilot提供非法输出,它就违反第1202条三次,即没有①注明出处,②版权通知,③许可条款的许可材料。因为两工具使用GitHub上的开源软件用于训练并输出,但并未按照要求进行致谢,版权声明和附上许可证,甚至标识错误,违反了上千万软件开发者的许可协议。原告进一步指称被告将其敏感个人数据一并纳入Copilot中向他人提供,构成违反开源许可证、欺诈、违反GitHub服务条款隐私政策等。14.4.1LLM的诉讼案例巴特里克强调:“我们反对的绝不是AI辅助编程工具,而是微软在Copilot当中的种种具体行径。微软完全可以把Copilot做得更开发者友好——比如邀请大家自愿参加,或者由编程人员有偿对训练语料库做出贡献。但截至目前,口口声声自称热爱开源的微软根本没做过这方面的尝试。另外,如果大家觉得Copilot效果挺好,那主要也是因为底层开源训练数据的质量过硬。Copilot其实是在从开源项目那边吞噬能量,而一旦开源活力枯竭,Copilot也将失去发展的依凭。”14.4.1LLM的诉讼案例(2)AI绘画工具被指控抄袭。2023年1月17日,全球知名图片提供商华盖创意起诉AI绘画工具StableDiffusion的开发者StabilityAI,称其侵犯了版权。1995年成立的华盖创意首创并引领了独特的在线授权模式——在线提供数字媒体管理工具以及创意类图片、编辑类图片、影视素材和音乐产品。华盖创意称StabilityAI在未经许可的情况下,从网站上窃取了数百万张图片训练自己的模型,使用他人的知识产权,为自己的经济利益服务,这不是公平交易,所以采取行动保护公司和艺术家们的知识产权。14.4.1LLM的诉讼案例2023年1月16日,莎拉·安德森、凯莉·麦克南和卡拉·奥尔蒂斯三名艺术家对StabilityAI,另一个AI绘画工具Midjourney以及艺术家作品集平台DeviantArt提出诉讼,称这些组织“未经原作者同意的情况下”通过从网络上获取的50亿张图像来训练其AI,侵犯了“数百万艺术家”的权利。负责这个案件的律师正是诉讼OpenAI和微软的马修·巴特里克,他描述此案为“为每一个人创造公平的环境和市场的第一步”。不过,一审法官驳回了大部分上述诉求,但颁布了法庭许可,允许原告在调整、补充起诉事由和证据材料后另行起诉。14.4.1LLM的诉讼案例事实上,Midjourney对这类问题表现得不屑一顾,认为:“没有经过授权,我们也没办法一一排查上亿张训练图像分别来自哪里。如果再向其中添加关于版权所有者等内容的元数据,那也太麻烦了。但这不是什么大事,毕竟网络上也没有相应的注册表,我们做不到在互联网上找一张图片、然后轻松跟踪它到底归谁所有,再采取措施来验证身份。既然原始训练素材未获许可,那即使在我们这帮非法律出身的外行来看,这都很可能激起各制片方、电子游戏发行商和演员的反抗。”14.4.1LLM的诉讼案例(3)看不见的幽灵与看得见的恐慌。一位名为Ghostwriter977的网友用Drake和TheWeeknd的声音对AI模型进行训练,同时模仿两人的音乐风格,最终生成并发布歌曲《袖子上的心》。该歌曲在不到两天的时间里,实现了病毒式的传播:在Spotify上播放量超过60万次,在TikTok上点击量超1500万次,完整版在YouTube平台上播放超27.5万次。值得注意的是,即便发布者并未在演唱信息中提及Drake和TheWeeknd,但该歌曲依然火了。14.4.1LLM的诉讼案例对很多人来说,这是AI音乐的第一首出圈之作,这是生成式AI进行创作的开始,也是环球音乐加速干预AIGC问题的标志。歌曲的蹿红很快引起环球音乐的注意。作为Drake和TheWeeknd的幕后唱片公司,公司对外发表言辞激烈的声明称:“使用我们旗下的艺术家对AI生成内容进行训练,这既违反了协议,也违反了版权法。”在环球音乐的投诉下,这首歌曲先从Spotify和AppleMusic下架。紧随其后,其他机构也撤下了该歌曲。14.4.1LLM的诉讼案例环球音乐指出,在流媒体平台上AI生成内容的可用性引发了一个问题,即音乐行业生态中的所有利益相关者到底希望站在历史的哪一边:“是站在艺术家、粉丝和人类创造性表达的一边,还是站在深度伪造、欺诈和剥夺艺术应得补偿的另一边。”很显然,在忍耐的极限后,业内巨头开启了对AI音乐的抵抗,环球音乐发函要求Spotify等音乐流媒体平台切断AI公司的访问权限,以阻止其版权歌曲被用于训练模型和生成音乐。14.4.1LLM的诉讼案例(4)ChatGPT屡屡惹官司。2023年2月15日,《华尔街日报》记者弗朗西斯科·马可尼公开指控OpenAI公司未经授权大量使用路透社、纽约时报、卫报、BBC等国外主流媒体的文章训练ChatGPT模型,但从未支付任何费用。14.4.1LLM的诉讼案例2023年6月28日,第一起具有代表性的ChatGPT版权侵权之诉出现在公众视野。两名畅销书作家保罗·特伦布莱和莫娜·阿瓦德在美国加州北区法院,向OpenAI提起集体诉讼,指控后者未经授权也未声明,利用自身享有版权的图书训练ChatGPT,谋取商业利益。同月16名匿名人士向美国加利福尼亚旧金山联邦法院提起诉讼,指控ChatGPT在没有充分通知用户,或获得同意的情况下,收集、存储、跟踪、共享和披露了他们的个人信息。他们称受害者据称可能多达数百万人,据此要求微软和OpenAI赔偿30亿美元。14.4.1LLM的诉讼案例2023年7月10日,美国喜剧演员和作家萨拉·希尔弗曼以及另外两名作家理查德·卡德雷、克里斯托弗·戈尔登在加州北区法院起诉OpenAI,指控ChatGPT所用的训练数据侵犯版权。同年9月19日,美国作家协会以及包括《权力的游戏》原著作者乔治·R·R·马丁在内的17位美国著名作家向美国纽约联邦法院提起诉讼,指控OpenAI“大规模、系统性地盗窃”,称OpenAI在未经授权的情况下使用原告作家的版权作品训练其大语言模型,公然侵犯了作家们登记在册的版权。14.4.1LLM的诉讼案例同年12月,含多名普利策奖得主在内的11位美国作家,在曼哈顿联邦法院起诉OpenAI和微软滥用自己作品训练LLM,指出这样的行为无疑是在“刮取”作家们的作品和其他受版权保护的材料,他们希望获得经济赔偿,并要求这些公司停止侵犯作家们的版权。14.4.1LLM的诉讼案例2023年12月27日,著名的《纽约时报》申请出战。《纽约时报》向曼哈顿联邦法院提起诉讼,指控OpenAI和微软未经许可使用该报数百万篇文章训练机器人。《纽约时报》要求获得损害赔偿,还要求永久禁止被告从事所述的非法、不公平和侵权行为,删除包含《纽约时报》作品原理的训练集等。虽然《纽约时报》并未提出具体的赔偿金额要求,但其指出被告应为“非法复制和使用《纽约时报》独特且有价值的作品”和与之相关的“价值数十亿美元的法定和实际损失”负责。14.4.1LLM的诉讼案例作为回应,当地时间2024年1月4日,OpenAI知识产权和内容首席汤姆·鲁宾在采访中表示,公司近期与数十家出版商展开了有关许可协议的谈判:“我们正处于多场谈判中,正在与多家出版商进行讨论。他们十分活跃积极,这些谈判进展良好。”据两名近期与OpenAI进行谈判的媒体公司高管透露,为了获得将新闻文章用于训练其LLM的许可,OpenAI愿意向部分媒体公司缴纳每年100万至500万美元的费用。虽然对于一些出版商来说,这是一个很小的数字,但如果媒体公司数量足够多,对OpenAI而言必然是一次“大出血”。14.4.1LLM的诉讼案例(5)Meta承认使用盗版书籍训练LLM,但否认侵权。2023年7月10日,莎拉等三人起诉OpenAI的同时也起诉了脸书的母公司Meta,指控其侵犯版权,使用包含大量盗版书籍的Books3数据集训练Llama系LLM后。公开资料显示,创建于2020年的Books3是一个包含19.5万本图书、总容量达37GB的文本数据集,旨在为改进机器学习算法提供更好的数据源,但其中包含大量从盗版网站Bibliotik爬取

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论