漏れたデータによって暴露された中国のAI検閲
中国がAIを活用して検閲能力を強化したことは、13万3000件のコンテンツが中国政府によって機密性のためにフラグ付けされた漏洩データベースによって明らかにされ、新たなレベルに達しています。この高度な大規模言語モデル(LLM)は、農村部の貧困から共産党内の腐敗、さらには微妙な政治的風刺まで、幅広いトピックに関連するコンテンツを自動的に検出し、検閲するように設計されています。

2019年6月4日に撮影されたこの写真は、中国西部の新疆地域、カシュガルの南にあるイェンギサールの住宅地で、有刺鉄線の背後にある中国国旗を示しています。画像クレジット:Greg Baker / AFP / Getty Images カリフォルニア大学バークレー校で中国の検閲を専門とする研究者、シャオ・チャンによると、このデータベースは中国政府またはその関連団体がLLMを使用して抑圧努力を強化している「明確な証拠」です。従来の人間のモデレーターやキーワードフィルタリングに依存する方法とは異なり、このAI駆動のアプローチは、国家が管理する情報管理の効率と精度を大幅に向上させることができます。
セキュリティ研究者のNetAskariが、Baiduサーバー上で保護されていないElasticsearchデータベースで発見したこのデータセットには、2024年12月からの最近のエントリーが含まれています。データセットを作成したのが誰かは不明ですが、その目的は明らかです:汚染、食品安全、金融詐欺、労働争議、軍事問題などの機密トピックに関連するコンテンツを特定し、フラグ付けするLLMを訓練することです。歴史的類推や台湾への言及を含む政治的風刺も、優先度の高いターゲットです。

画像クレジット:Charles Rollet トレーニングデータには、腐敗した警察官への不満、農村部の貧困に関する報告、共産党から追放された役人に関するニュースなど、社会不安を引き起こす可能性のあるさまざまなコンテンツの例が含まれています。データセットには、台湾や軍事関連のトピックへの広範な言及も含まれており、「台湾」という中国語が1万5000回以上出現しています。
データセットの意図された用途は「世論工作」と記述されており、Article 19のマイケル・キャスターが説明するところでは、通常、中国サイバースペース管理局(CAC)に関連し、検閲とプロパガンダの努力を伴います。これは、中国の習近平国家主席がインターネットを共産党の世論工作の「最前線」と見なす見解と一致しています。
この発展は、権威主義政権が抑圧目的でAI技術を採用する広範な傾向の一部です。OpenAIは最近、中国と思われる未特定のアクターが生成AIを使用してソーシャルメディアを監視し、反政府的な投稿を中国政府に転送していたと報告しました。同じ技術は、著名な中国の反体制派、蔡霞に対する批判的なコメントを生成するためにも使用されました。
中国の従来の検閲方法は、ブラックリストに登録された用語をブロックする基本的なアルゴリズムに依存していますが、LLMの使用は大きな進歩を表しています。これらのAIシステムは、大規模な微妙な批判を検出し、データを処理するにつれて継続的に改善することができます。
「AI駆動の検閲がどのように進化しているかを強調することは、特にDeepSeekのような中国のAIモデルが注目を集めている時期に、国家が公共の言論をより高度に制御していることを示すために重要だと思います」と、シャオ・チャンはTechCrunchに語りました。
関連記事
XPeng Motors傘下のDogotixが9億ドルの資金調達に成功
XPeng傘下のDogotixは、ヒューマノイドロボット「IRON」を開発している。出典:XPeng世界の主要自動車メーカーに続き、XPeng Motorsもヒューマノイドロボット分野への事業拡大を進めている。 この電気自動車メーカーは本日、子会社であるロボット事業部門「Dogotix」が、初の資金調達ラウンドで9億ドル以上を調達し、プレマネー評価額が50億ドル、取引後の評価額が63億ドルを超えた
3人のAIの先駆者が、安全への懸念が高まる中、大規模モデルをオープンに維持するよう主張する
Pacing the Frontierのような取り組みは、主要なラボと提携することでAIの安全性を確保することを目指していますが、オープンソースモデルは業界内で依然として論争の的となっています。無償で配布され、使用制限がないため、オープンウェイトモデルの規制は困難であり、一部の組織はこれに大きな懸念を抱いています。しかし、先週ラスベガスで開催されたAi4会議において、ノーベル賞受賞者のジェフリー・ヒントン氏、World LabsのCEO兼共同創設者のフェイフェイ・リー氏、Courseraの共同
9億米ドルの資金調達が、XPENGのロボティクスビジョンをどう形作るか
XPENGのロボティクス部門は9億米ドル以上の資金調達に成功し、ポストマネー評価額が63億米ドルを超え、フィジカルAIの展開を加速させることとなった。写真提供:XPENGXPENG Europeのブランド・マーケティング責任者であるSven De Smet氏は、9億米ドルを超える評価額で実施されたシリーズAの資金調達ラウンドについて、ヒューマノイドロボットのグローバル展開における転換点であると述べ
関連特集おすすめ
コメント (39)
0/500
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀
中国がAIを活用して検閲能力を強化したことは、13万3000件のコンテンツが中国政府によって機密性のためにフラグ付けされた漏洩データベースによって明らかにされ、新たなレベルに達しています。この高度な大規模言語モデル(LLM)は、農村部の貧困から共産党内の腐敗、さらには微妙な政治的風刺まで、幅広いトピックに関連するコンテンツを自動的に検出し、検閲するように設計されています。

カリフォルニア大学バークレー校で中国の検閲を専門とする研究者、シャオ・チャンによると、このデータベースは中国政府またはその関連団体がLLMを使用して抑圧努力を強化している「明確な証拠」です。従来の人間のモデレーターやキーワードフィルタリングに依存する方法とは異なり、このAI駆動のアプローチは、国家が管理する情報管理の効率と精度を大幅に向上させることができます。
セキュリティ研究者のNetAskariが、Baiduサーバー上で保護されていないElasticsearchデータベースで発見したこのデータセットには、2024年12月からの最近のエントリーが含まれています。データセットを作成したのが誰かは不明ですが、その目的は明らかです:汚染、食品安全、金融詐欺、労働争議、軍事問題などの機密トピックに関連するコンテンツを特定し、フラグ付けするLLMを訓練することです。歴史的類推や台湾への言及を含む政治的風刺も、優先度の高いターゲットです。

トレーニングデータには、腐敗した警察官への不満、農村部の貧困に関する報告、共産党から追放された役人に関するニュースなど、社会不安を引き起こす可能性のあるさまざまなコンテンツの例が含まれています。データセットには、台湾や軍事関連のトピックへの広範な言及も含まれており、「台湾」という中国語が1万5000回以上出現しています。
データセットの意図された用途は「世論工作」と記述されており、Article 19のマイケル・キャスターが説明するところでは、通常、中国サイバースペース管理局(CAC)に関連し、検閲とプロパガンダの努力を伴います。これは、中国の習近平国家主席がインターネットを共産党の世論工作の「最前線」と見なす見解と一致しています。
この発展は、権威主義政権が抑圧目的でAI技術を採用する広範な傾向の一部です。OpenAIは最近、中国と思われる未特定のアクターが生成AIを使用してソーシャルメディアを監視し、反政府的な投稿を中国政府に転送していたと報告しました。同じ技術は、著名な中国の反体制派、蔡霞に対する批判的なコメントを生成するためにも使用されました。
中国の従来の検閲方法は、ブラックリストに登録された用語をブロックする基本的なアルゴリズムに依存していますが、LLMの使用は大きな進歩を表しています。これらのAIシステムは、大規模な微妙な批判を検出し、データを処理するにつれて継続的に改善することができます。
「AI駆動の検閲がどのように進化しているかを強調することは、特にDeepSeekのような中国のAIモデルが注目を集めている時期に、国家が公共の言論をより高度に制御していることを示すために重要だと思います」と、シャオ・チャンはTechCrunchに語りました。
XPeng Motors傘下のDogotixが9億ドルの資金調達に成功
XPeng傘下のDogotixは、ヒューマノイドロボット「IRON」を開発している。出典:XPeng世界の主要自動車メーカーに続き、XPeng Motorsもヒューマノイドロボット分野への事業拡大を進めている。 この電気自動車メーカーは本日、子会社であるロボット事業部門「Dogotix」が、初の資金調達ラウンドで9億ドル以上を調達し、プレマネー評価額が50億ドル、取引後の評価額が63億ドルを超えた
3人のAIの先駆者が、安全への懸念が高まる中、大規模モデルをオープンに維持するよう主張する
Pacing the Frontierのような取り組みは、主要なラボと提携することでAIの安全性を確保することを目指していますが、オープンソースモデルは業界内で依然として論争の的となっています。無償で配布され、使用制限がないため、オープンウェイトモデルの規制は困難であり、一部の組織はこれに大きな懸念を抱いています。しかし、先週ラスベガスで開催されたAi4会議において、ノーベル賞受賞者のジェフリー・ヒントン氏、World LabsのCEO兼共同創設者のフェイフェイ・リー氏、Courseraの共同
9億米ドルの資金調達が、XPENGのロボティクスビジョンをどう形作るか
XPENGのロボティクス部門は9億米ドル以上の資金調達に成功し、ポストマネー評価額が63億米ドルを超え、フィジカルAIの展開を加速させることとなった。写真提供:XPENGXPENG Europeのブランド・マーケティング責任者であるSven De Smet氏は、9億米ドルを超える評価額で実施されたシリーズAの資金調達ラウンドについて、ヒューマノイドロボットのグローバル展開における転換点であると述べ
Whoa, 133,000 flagged posts? That's wild! China's AI censorship game is intense, but I'm curious—how do they even decide what's 'sensitive'? Sounds like a slippery slope. 😬
This leak is wild! 133,000 flagged posts show how deep China's AI censorship goes. It's like a digital Big Brother on steroids. 😳 Makes you wonder how much we're not seeing online.
This leak is wild! 133,000 flagged posts? That’s a scary peek into how AI’s being used to control speech in China. Makes you wonder how much is being filtered without us knowing. 😳
Essa ferramenta é reveladora! Mostra como a censura por AI na China é profunda. O vazamento do banco de dados é um pouco assustador, mas é importante saber o que está acontecendo nos bastidores. Definitivamente, algo que todos interessados em liberdade na internet devem conhecer. Fique de olho nisso! 👀





家






