EN FR ES PT DE AR 中文

你的下架系统:惩罚守法者,放过真盗版

版权下架机制把误删的成本定为零,把漏删的成本定为天价,于是系统被精确调校成打压守规矩的用户,而真正的侵权者只需花一个下午做点表面修改就能全身而退。这不是故障,是设计本该如此运作。

每一套自动化执法系统都有同一个盲区:它抓到的往往是那些从未打算逃跑的人。顺着机制往下看就明白了:一套靠指纹比对和通知匹配运作的下架系统,只能识别出与训练样本相似的东西。守法用户,无论是合理引用、正当评测、恶搞创作还是合法转售,都不会刻意掩饰自己在做什么,于是他们的特征和过滤器精确吻合。而铁了心要侵权的人只要把文件镜像翻转、缩放百分之三、或者对着屏幕重新翻拍一遍,就能顺利过关。系统分辨的从来不是诚实与不诚实,它分辨的是「容易识别」与「刻意规避」,而诚实的人,恰恰就是最容易被识别的那批。

如果周围的激励机制是中立的,这顶多算个工程上的小麻烦。可惜并不是。美国的避风港条款规定,平台要想获得责任豁免,就必须运作一套通知删除机制,并对重复侵权者执行终止政策。看看这套激励结构制造出的收益矩阵:误删一位守法用户的作品,平台的代价几乎为零,道个歉、必要时恢复账号,不会有任何赔偿;漏删一份侵权文件,一旦遇上大版权方追究,面对的可能是按整个作品库倍数计算的法定赔偿。误删不罚,漏删则可能倾家荡产。任何理性的运营者都会把判定门槛往「宁可错杀」的方向调。压制自己的守法客户不是分类器出了故障,而是这套激励设计给出的正确产出。

为什么自动下架系统总在惩罚守法用户?

因为「被检测到」和「躲过检测」的成本天差地别。搭建一套匹配系统很昂贵,破解它却只需要一次表面修改。于是长期保持「可被检测」状态的人群,渐渐收敛成那些从来没想过要规避的人,也就是那些根本没做错事的人。守法用户最终要为此付出一笔隐形的合规税:争议下架、账号被停、以及不得不进行的自我审查,而真正被这套系统盯上的目标却一分钱都不用付。

行业公布的又恰好是错误的那个数字。执法效果被简化成删除量:透明度报告里罗列出数百万次下架、数千次封号,年年数字更漂亮。可数量衡量的是活动强度,而不是效果。如果这些删除里有相当一部分打在了合法活动上,而真正的侵权者一小时内就能重新上传,那么这个漂亮的头条数字记录的其实是对客户造成的伤害,却被包装成保护成果。真正有意义的指标,是「误伤合规活动」与「真正遏制侵权」的比例。没有一家平台会公开这个数字,因为老老实实算出来会很难堪。

Cox诉Sony案修正了什么,又没修正什么?

当责任追溯到基础设施层面时,风险最高。接入服务商Cox Communications曾面临约十亿美元的赔偿判决,依据的理论是:一家宽带运营商如果在收到足够多的侵权通知后仍继续为某个用户提供服务,就等同于共同侵权。留意这套理论逼出的救济方式:宽带商没法删除某个文件或下架某条商品链接,它唯一的杠杆就是整个账号。于是制裁变成了让一整个家庭彻底断网,一项从未经法院审理、仅凭指控就执行的处罚。

一旦责任落在了「管道」本身,惩罚永远是整条管道一起承担。

美国最高法院已经改判了该案中的帮助侵权认定,裁定责任成立需要证明存在故意,也就是诱导侵权或服务本身就是为侵权而设计,而不能仅凭「知情却仍继续提供服务」就成立。这个修正方向是对的,但对合规团队来说,能松的这口气比想象中要窄得多。公司在十亿美元理论悬而未决期间搭建的封号流水线和账号评分系统,并不会因为一份判决书就自动下线。机器的寿命往往比支撑它的法理更长,而它的判定门槛,仍然停留在旧的那套收益矩阵上。

各国政府也注意到了这套机器的用处。一个想压制某种言论的政权,不再需要立法禁止再上法庭辩护,它只需要找到一个握有责任豁免、又怕失去豁免的中介机构。删除的动作由中介完成,政府本身从不需要走审判程序,被压制的人也找不到可以起诉的对象。司法趋势还在为这条路铺得更平:在Free Speech Coalition诉Paxton案中,美国最高法院以中等审查标准而非严格审查标准,维持了得克萨斯州一项年龄验证法律,反对意见则警告,放宽对内容相关规则的审查力度,等于给立法机构提供了一套可以反复套用的模板。无论你如何看待年龄验证本身,结构性的问题都成立:每一次法院放宽对言论相关监管的审查力度,都让「中间商」变成政府用来执法的更廉价工具。

比起下架数量,应该衡量什么?

这已经不只是平台要面对的问题。电商市场、支付服务商、广告网络和主机服务商都在被推着搭建自己的执法流水线,而多数公司把这单纯当成风险控制项目来做预算。如果你也在其中,有四个数字能告诉你,你搭的这套系统究竟在执法,还是只是在向守法者征税。追踪申诉改判率,因为改判率高就意味着你的误删率其实就是客户受损率。对已生效的下架决定做抽样,交由独立方复核,因为没有申诉的用户不代表你判断得对。观察内容的复发情况:如果被删的内容几天内就以稍作修改的样子重新出现,说明你抓到的所谓「真凶」不过是表面功夫。把人工判断放在真正会伤人的那个决策点上,也就是封号或断网,而不是放在多数人根本走不到的申诉队列末端;这个「放在哪一步」的问题,正是让自动化系统保持在真正的人工掌控之下的核心。

为自动化辩护最诚实的理由是,这个规模下人工逐条审核根本做不到,这话没错。但问题的根源不在分类器的准确率。哪怕换一个完美的分类器,只要还是在同一套收益矩阵下运作,依然会过度删除,因为判定门槛是由责任风险决定的,不是由准确度决定的。这些系统面对的是有动机的对抗方和不对称的激励结构,这让它们本质上是对抗性系统问题,而不是内容问题,把它设计好,是战略工作,而不是采购工作。除非从根本上重新定价这套不对称机制,让错误删除承担真实成本、让封号前有真正的程序保障,否则再怎么升级模型,这个天平都不会摆正。

一套删掉了一百万个文件却没抓到真盗版的系统,什么都没有执法到。它只是把守法者的账单开给了侵权者的行为,还把这张账单包装成了成功指标。

常见问题

如果DMCA下架通知发错了怎么办?

法律确实设有反通知程序,理论上可以恢复被删内容,但激励机制对用户不利:平台错误删除不用承担任何赔偿,所以恢复往往缓慢且全凭平台自由裁量,而删除本身却是即时执行的。实际操作中,举证责任落在被指控的一方身上,这正是导致过度执法的那个不对称结构。

重复侵权者政策是否意味着宽带商必须给被指控的用户断网?

获得避风港保护的前提之一,确实是维持一套在适当情形下终止重复侵权者的政策,但美国最高法院在Cox诉Sony案改判后明确,宽带商不会仅因为知情并继续提供服务就被视为共同侵权,责任成立需要证明存在故意。单凭指控并不必然导致断网,但许多服务商的自动化流水线,至今仍按「指控即断网」的逻辑在运转。

如何审计一套内容审核系统的误判率?

衡量申诉改判率,对已生效的下架决定做随机抽样交由独立方复核,并追踪被删内容以稍作修改的形式重新出现的速度。把这三项数字放在一起,大致就能估算出那个真正重要的比例:你每遏制一单位的真实侵权行为,同时误伤了多少合规活动。

相关阅读

本文由 Abyshire 专有编辑系统的 AI 编辑角色撰写,并经我们的团队审核。