中国人工智能审查制度被泄漏的数据暴露
中国利用人工智能增强其审查能力已达到一个新水平,一份泄露的数据库显示,中国政府标记了133,000个敏感内容示例。这一复杂的大型语言模型(LLM)旨在自动检测和审查与多种话题相关的内容,从农村贫困到共产党内部的腐败,甚至是微妙的政治讽刺。

这张摄于2019年6月4日的照片显示,中国西部新疆地区喀什以南的焉耆县一处住宅区内,中国国旗在铁丝网后。图片来源:Greg Baker / AFP / Getty Images 据加州大学伯克利分校专门研究中国审查制度的研究员肖强表示,这一数据库是“明确证据”,证明中国政府或其关联机构正在使用大型语言模型来加强其压制努力。与依赖人工审查员和关键词过滤的传统方法不同,这种人工智能驱动的方法可以显著提高国家控制信息管理的效率和精确度。
该数据集由安全研究员NetAskari在一个未受保护的、托管在百度服务器上的Elasticsearch数据库中发现,包含2024年12月的最新条目。目前尚不清楚具体是谁创建了这个数据集,但其目的显而易见:训练大型语言模型以识别和标记与敏感话题相关的内容,如污染、食品安全、金融诈骗、劳动争议和军事事务。政治讽刺,尤其是涉及历史类比或台湾的内容,也是优先审查目标。

图片来源:Charles Rollet 训练数据包括可能引发社会动荡的各种内容示例,如对腐败警察的投诉、关于农村贫困的报道,以及关于被开除的共产党官员的新闻。数据集还包含大量关于台湾和军事相关话题的提及,其中“台湾”一词出现了超过15,000次。
数据集的用途被描述为“舆论工作”,Article 19的Michael Caster解释说,这个术语通常与中国国家互联网信息办公室(CAC)相关,涉及审查和宣传工作。这与习近平主席将互联网视为共产党舆论工作“前线”的观点一致。
这一发展是专制政权采用人工智能技术进行压制目的的更广泛趋势的一部分。OpenAI最近报告称,一个可能是来自中国的未识别行为者使用生成式人工智能监控社交媒体,并将反政府帖子转发给中国政府。同一技术还被用于生成针对著名中国异见人士蔡霞的批评评论。
虽然中国的传统审查方法依赖基本算法来屏蔽黑名单术语,但使用大型语言模型代表了重大进步。这些人工智能系统可以大规模检测甚至微妙的批评,并随着处理更多数据而不断改进。
“我认为必须强调人工智能驱动的审查如何演变,使国家对公共话语的控制更加复杂,尤其是在DeepSeek等中国人工智能模型掀起波澜的时刻,”肖强对TechCrunch表示。
相关文章
小鹏汽车旗下的Dogotix完成9亿美元融资
小鹏汽车旗下的Dogotix部门正在研发IRON人形机器人。来源:小鹏汽车效仿其他全球主要汽车制造商的做法,小鹏汽车正将业务拓展至类人机器人领域。 这家电动汽车制造商今日宣布,其机器人子公司Dogotix在首轮融资中筹集了超过9亿美元,此轮融资前的估值为50亿美元,交易后的估值超过63亿美元。据小鹏汽车称,这笔资金将用于推进软硬件开发、收集运营数据、训练物理AI模型、建立量产设施,并推动全球业务扩
三位人工智能先驱在安全担忧日益加剧之际,主张保持大型模型的开放性
诸如“前沿节奏”(Pacing the Frontier)之类的倡议旨在通过与主要实验室合作来确保人工智能安全,然而开源模型在行业内仍是一个充满争议的话题。由于其免费分发且缺乏使用控制,开源权重模型难以监管,导致一些机构对此感到高度担忧。然而,在上周于拉斯维加斯举行的 Ai4 会议上,三位著名的人工智能专家——诺贝尔奖得主杰弗里·辛顿(Geoffrey Hinton)、World Labs 首席执行官兼联合创始人李飞飞(Fei-Fei Li)以及 Coursera 联合创始人吴恩达(Andre
9亿美元融资将如何塑造小鹏汽车的机器人愿景
小鹏汽车机器人事业部获得逾9亿美元融资,投后估值突破63亿美元,将加速物理人工智能的部署。图片来源:小鹏汽车小鹏汽车欧洲品牌与市场总监斯文·德·斯梅特(Sven De Smet)将此轮估值超过9亿美元的A轮融资,视为类人机器人全球推广的关键时刻。作为具身AI领域的领军企业,小鹏汽车已签署股份购买协议,为其机器人子公司筹集逾9亿美元资金。此次交易是中国具身AI领域迄今为止规模最大的单轮私募融资。本轮
相关专题推荐
评论 (39)
0/500
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀
中国利用人工智能增强其审查能力已达到一个新水平,一份泄露的数据库显示,中国政府标记了133,000个敏感内容示例。这一复杂的大型语言模型(LLM)旨在自动检测和审查与多种话题相关的内容,从农村贫困到共产党内部的腐败,甚至是微妙的政治讽刺。

据加州大学伯克利分校专门研究中国审查制度的研究员肖强表示,这一数据库是“明确证据”,证明中国政府或其关联机构正在使用大型语言模型来加强其压制努力。与依赖人工审查员和关键词过滤的传统方法不同,这种人工智能驱动的方法可以显著提高国家控制信息管理的效率和精确度。
该数据集由安全研究员NetAskari在一个未受保护的、托管在百度服务器上的Elasticsearch数据库中发现,包含2024年12月的最新条目。目前尚不清楚具体是谁创建了这个数据集,但其目的显而易见:训练大型语言模型以识别和标记与敏感话题相关的内容,如污染、食品安全、金融诈骗、劳动争议和军事事务。政治讽刺,尤其是涉及历史类比或台湾的内容,也是优先审查目标。

训练数据包括可能引发社会动荡的各种内容示例,如对腐败警察的投诉、关于农村贫困的报道,以及关于被开除的共产党官员的新闻。数据集还包含大量关于台湾和军事相关话题的提及,其中“台湾”一词出现了超过15,000次。
数据集的用途被描述为“舆论工作”,Article 19的Michael Caster解释说,这个术语通常与中国国家互联网信息办公室(CAC)相关,涉及审查和宣传工作。这与习近平主席将互联网视为共产党舆论工作“前线”的观点一致。
这一发展是专制政权采用人工智能技术进行压制目的的更广泛趋势的一部分。OpenAI最近报告称,一个可能是来自中国的未识别行为者使用生成式人工智能监控社交媒体,并将反政府帖子转发给中国政府。同一技术还被用于生成针对著名中国异见人士蔡霞的批评评论。
虽然中国的传统审查方法依赖基本算法来屏蔽黑名单术语,但使用大型语言模型代表了重大进步。这些人工智能系统可以大规模检测甚至微妙的批评,并随着处理更多数据而不断改进。
“我认为必须强调人工智能驱动的审查如何演变,使国家对公共话语的控制更加复杂,尤其是在DeepSeek等中国人工智能模型掀起波澜的时刻,”肖强对TechCrunch表示。
小鹏汽车旗下的Dogotix完成9亿美元融资
小鹏汽车旗下的Dogotix部门正在研发IRON人形机器人。来源:小鹏汽车效仿其他全球主要汽车制造商的做法,小鹏汽车正将业务拓展至类人机器人领域。 这家电动汽车制造商今日宣布,其机器人子公司Dogotix在首轮融资中筹集了超过9亿美元,此轮融资前的估值为50亿美元,交易后的估值超过63亿美元。据小鹏汽车称,这笔资金将用于推进软硬件开发、收集运营数据、训练物理AI模型、建立量产设施,并推动全球业务扩
三位人工智能先驱在安全担忧日益加剧之际,主张保持大型模型的开放性
诸如“前沿节奏”(Pacing the Frontier)之类的倡议旨在通过与主要实验室合作来确保人工智能安全,然而开源模型在行业内仍是一个充满争议的话题。由于其免费分发且缺乏使用控制,开源权重模型难以监管,导致一些机构对此感到高度担忧。然而,在上周于拉斯维加斯举行的 Ai4 会议上,三位著名的人工智能专家——诺贝尔奖得主杰弗里·辛顿(Geoffrey Hinton)、World Labs 首席执行官兼联合创始人李飞飞(Fei-Fei Li)以及 Coursera 联合创始人吴恩达(Andre
9亿美元融资将如何塑造小鹏汽车的机器人愿景
小鹏汽车机器人事业部获得逾9亿美元融资,投后估值突破63亿美元,将加速物理人工智能的部署。图片来源:小鹏汽车小鹏汽车欧洲品牌与市场总监斯文·德·斯梅特(Sven De Smet)将此轮估值超过9亿美元的A轮融资,视为类人机器人全球推广的关键时刻。作为具身AI领域的领军企业,小鹏汽车已签署股份购买协议,为其机器人子公司筹集逾9亿美元资金。此次交易是中国具身AI领域迄今为止规模最大的单轮私募融资。本轮
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀





首页






