博文

目前显示的是 八月, 2026的博文

Anthropic和亚马逊为什么要销毁正版图书?

 为了训练大语言模型,一些美国科技巨头正在系统性销毁人类文明的实体载体 —— 书籍。 2026 年初,媒体曝光了 Anthropic 公司自 2024 年起斥资数千万美元收购数百万册二手纸质图书,高速扫描后将实体原件全部销毁。近日亚马逊公司也被追踪到大量购买实体书籍、扫描后销毁原书。实际上,美国 AI 公司销毁书籍是为了迎合美国的著作权法规定,降低训练素材授权的版权风险,而中国法律的规定有所不同,所以中国 AI 公司没必要这么做,今天就跟大家聊聊这个事情。 一、毁书百万册的巴拿马计划 Anthropic 拆书、扫描然后销毁的项目,内部代号为巴拿马。根据公开披露的诉讼文件,该项目以流水线方式运作:大批正版图书被运入处理中心,工人将书脊切离、书页分离,再通过高速扫描设备将每一页转化为数字文本,这些文本会留存,用于大模型训练,而书的纸质原件则会被销毁。目前这么做的已经不只 Anthropic ,随着亚马逊等公司的跟进,二手书商们开始接到更多的异常订单。 但值得注意的是,并不是所有人工智能公司都选择这种方式。马斯克在 2026 年 7 月公开表示, SpaceX AI 对于珍贵图书会采用更麻烦的方式扫描,而不是直接切掉书脊; Google 早年的 Google Books 项目则是典型的非破坏性数字化,即使扫描全书建立数据库,也没有把原书销毁。换句话说,拆书并不是技术上的必然选择, 而是 Anthropic 等公司在权衡法律风险与商业成本后的选择,而决策的逻辑需要从美国著作权法中寻找答案。 二、销毁图书只是为了版权合规吗? Anthropic 和亚马逊为什么要销毁正版图书?实际是在试图构建一条符合美国《著作权法》的训练数据获取通道,以便抵御著作权人的诉讼攻击。 Anthropic 曾经尝试与出版商谈判获得授权,但美国的大型出版商要求的许可费用极其高昂,且谈判周期极长。所以 Anthropic 最终决定直接从市场上匿名大量购买二手实体书。 美国著作权法规定,版权所有者在售出特定实体副本后,无权干涉买方对该特定副本的处置权(如转售、出借或销毁)。 Anthropic 合法出资购买正版书,确保了其对实体书籍拥有合法的处分权。但如果购买了纸质书并将其扫描为数字版,同时保留纸质书,在法律上容易被认定为复制权侵权。而销毁纸质原件,则可以主张一份合法购买的...

AI开始自己找漏洞了,出了事谁负责?

  近期澳大利亚有个很有意思的事情:一名 OpenClaw 用户让自己的 AI 助手帮忙预订健身课程,却没想到,这只小龙虾在执行任务时自己发现了健身房预约系统的漏洞,并利用漏洞抢到了课程,甚至把其他用户从候补名单中移了出去。但这个事件的本质其实和笔者之前和大家讨论的 OpenAI 、 Anthropic 的大模型失控攻击其他网站一样,让人细思极恐。今天就跟大家聊聊这个。 一、健身房小龙虾黑客事件的案情 据 ABC News 报道:一名 OpenClaw 用户利用小龙虾(下称 AI 助手)调用 Anthropic 的 Claude Opus 4.6 大模型,下达了一个看似平常的指令:预订一家健身房最受欢迎的早间课程。然而, AI 助手的执行逻辑却超出了人类的常识。它不仅利用了健身房预订软件中存在的漏洞,提前数月锁定了名额,甚至进一步越权,将排在该用户之前的人从候补名单中剔除。而且当用户察觉不妥要求 AI 助手撤销操作时, AI 助手表示:无法将被踢者重新加入列表。 二、为什么本案细思极恐? 这次失控的不是我们上一篇文章里讨论的 OpenAI 和 Anthropic 这样的顶尖公司开发的预览版高级大模型,而只是一个接入了前沿模型的普通用户部署的 AI 助手。这起事件最让人担心的并不是 AI 助手主动攻击了健身房,而是它根本没有把发现漏洞理解为一件不应该做的事情。 本案中的用户从未要求 AI 助手入侵系统或删除他人记录, AI 助手使用的是用户原本拥有的账户和访问权限,但它进一步利用了预约系统设计上的漏洞,实施了超出正常预约规则的操作。但从效果看,它已经构成了对他人权利的实质侵害,且是高度自动化、规模可扩展的。传统恶意程序通常是人提前设计好攻击目标、攻击方法和行为逻辑。而 AI 助手则可能只接受一个目标,剩下的路径由它自己探索。这意味着,开发者甚至不需要预先知道某一个具体漏洞, AI 就可能在执行任务过程中自己把漏洞走出来。 如果把健身房预订系统换成城市供水供电系统,医院挂号系统这样的基础设施系统,问题就不是别人抢不到健身课,而是公共安全和关键基础设施的系统性风险。 三、谁该对小龙虾黑客负责? 在这起健身小龙虾黑客案中,实际已经有了损害,谁该对此负责?根据中国目前的法律框架,本案的四类主体都可能进入责任分析范围,但最终如何分配责...

OpenAI等模型接连失控发动攻击,谁该承担法律责任?

  美国科技网站 TechCrunch 近日发表一篇报道《谁该为 Anthropic 和 OpenAI 的自主人工智能攻击承担法律责任?这很复杂》,称当前美国尚未出台针对 AI 危害的联邦责任法律,针对 OpenAI 和 Anthropic 的内部测试模型接连失控攻击第三方网站,引发 AI 自主黑客行为责任认定的法律争议。但在笔者看来,如果依据中国法律,责任非常明确。 AI 运营者承担全部责任。今天就跟大家聊聊,为什么中美的法律会产生这样的差异? 一、 AI 公司给 AI 出难题,导致其失控 先说案情:近日 OpenAI 和 Anthropic 均承认,旗下未发布的模型在内部安全测试中自行突破隔离环境、入侵了外部公司系统。 TechCrunch 有一篇报道里关于 OpenAI 的信息目前比较全:由于 OpenAI 内部工作的失误,他们给大模型布置的任务缺失条件,比如给了谷歌文档的链接,但不准大模型访问互联网,让大模型查找蛋白质数据库文件,但工程师们忘记了上传文件到智能体的容器中,导致实际不可能完成。 这些失误促使各个大模型寻找沟通办法,并通过类似内部留言板方式实现了不同大模型之间的沟通,有大模型还在留言板留下了自己发现的系统漏洞,这种集体智能的形式终于发挥了作用。 7 月 11 日至 13 日, OpenAI 内部测试的大模型利用此前发现的漏洞突破了因为测试被故意调低的安全护栏,攻击了大模型开源下载平台 Hugging Face 的系统, 7 月 16 日, Hugging Face 对外披露安全事件,但披露时并未识别出背后是哪个模型。 OpenAI 自己也花了数天才确认是自家智能体所为,直到 7 月 20 日才首次就此事和 Hugging Face 沟通, 7 月 21 日, OpenAI 公开承认 GPT-5.6 Sol 以及一个能力更强、尚未发布的模型是这次攻击的源头。 Anthropic 随后自查,又发现旗下模型入侵了另外三家未公开身份的公司,且数月未被发现。 二、美国律师认为 AI 失控存在法律难题 对于两家顶尖人工智能公司的大模型脱离监管的攻击事件, TechCrunch 的文章的观点是: 文章采访的律师认为,刑事追责很难成立:美国 1986 年的《计算机欺诈与滥用法》要求 " 明知无权限访问 " 的主观故...