AIチャットボット、開発者が考案した話題のテストに直面
ペンネーム "xlr8harder "で活動する開発者は、主要なAIチャットボットが論争的なトピックをどのように扱うかを分析する "言論の自由評価 "ツール、SpeechMapを立ち上げた。このプラットフォームは、OpenAIのChatGPTやxAIのGrokのようなモデルで、政治的言説、公民権に関する議論、抗議関連のクエリに関する応答を比較する。
このイニシアチブは、AI企業がそのシステムにおける政治的偏見の認識に関する監視の高まりに直面する中で浮上した。イーロン・マスクやデビッド・サックスなど、ホワイトハウスの盟友や著名なテック関係者は、主流のチャットボットが進歩的な検閲を行っていると非難している。
AI企業はこれらの疑惑に直接対処していないが、いくつかの企業は対応策を示した。Meta社は最近、Llamaのモデルを調整し、議論されるテーマを扱う際に特定の政治的視点を優先しないようにした。
SpeechMapの開発者は、その動機をこう説明している:「このような会話は公共圏に属するものであり、企業の役員室に限定されるものではありません。私のプラットフォームは、客観的なテストを通じて、ユーザーが直接データを検証できるようにするものです。"
評価方法は、政治的コメント、歴史的解釈、国家シンボルの分類にわたってチャットボットの応答を評価するAI裁判官を採用している。各インタラクションは以下のように分類される:
- 完全なコンプライアンス(直接回答)
- 回避的な回答
- 明白な拒否
Xlr8harderは、潜在的なジャッジモデルのバイアスや技術的な矛盾など、方法論的な限界を認めている。しかし、収集されたデータから、主要なAIシステムにおける注目すべき行動パターンが明らかになった。
注目すべき発見としては、OpenAIの政治的言説に対するアプローチの進化が挙げられる。OpenAIの2月のコミットメントにもかかわらず、最近のGPTの反復では、物議を醸す問題に対してよりバランスの取れた視点を提示するために、デリケートなトピックを扱う際に抑制が強まっています。

SpeechMapデータに基づくOpenAIモデルの応答傾向 分析によると、xAIのGrok 3は、テストされたモデルの中で最も自由奔放であり、業界平均の応答率71.3%に対し、96.2%のプロンプトに応答した。これは、Grokを "覚醒した "AIシステムのフィルタリングされていない代替品とするマスク氏の当初の位置づけと一致している。
「ほとんどのモデルが政治的な発言を制限するようになっている一方で、xAIは意図的に会話の制限を少なくする方向に向かっているようです」とSpeechMapの開発者は述べている。
初期のGrokバージョンは、マスクCEOの中立性の誓約にもかかわらず、ジェンダーアイデンティティや経済的不平等のような問題に関して進歩的な傾向を示していた。同CEOは以前、これらのバイアスは公共のウェブソースからのトレーニングデータの影響によるものだとしていた。
最近の評価では、Grok 3はより政治的中立性を高めているが、このシステムは以前、マスクの否定的なコメントを一時的に検閲したことで批判を浴びた。この進化は、表現の自由の原則と、AI開発者が直面するコンテンツモデレーションの課題との間の継続的な緊張を反映している。
関連記事
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
関連特集おすすめ
コメント (3)
0/500
SpeechMapって面白い試みだね。GrokとChatGPTの回答を比較できるなら、各AIの「安全フィルター」の境界線がどこにあるのか可視化されていいかも。ただ、xlr8harderという匿名の開発者が作ったツールだから、バイアスがかかってないか疑ってかかるのも自然な反応だよね。AIの倫理基準が統一されない限り、こういう「テスト」は増えそうだ。
Die Idee ist interessant, aber so ein Benchmark bringt doch immer die Voreingenommenheit des Entwicklers selbst mit rein, oder? 🤔 Die Ergebnisse sollten nicht überinterpretiert werden. Dennoch gut zu sehen, ob manche Modelle wirklich 'ausweichen' oder offen diskutieren. Technisch aber wahrscheinlich recht simpel umgesetzt - ist der Wert also begrenzt?
ペンネーム "xlr8harder "で活動する開発者は、主要なAIチャットボットが論争的なトピックをどのように扱うかを分析する "言論の自由評価 "ツール、SpeechMapを立ち上げた。このプラットフォームは、OpenAIのChatGPTやxAIのGrokのようなモデルで、政治的言説、公民権に関する議論、抗議関連のクエリに関する応答を比較する。
このイニシアチブは、AI企業がそのシステムにおける政治的偏見の認識に関する監視の高まりに直面する中で浮上した。イーロン・マスクやデビッド・サックスなど、ホワイトハウスの盟友や著名なテック関係者は、主流のチャットボットが進歩的な検閲を行っていると非難している。
AI企業はこれらの疑惑に直接対処していないが、いくつかの企業は対応策を示した。Meta社は最近、Llamaのモデルを調整し、議論されるテーマを扱う際に特定の政治的視点を優先しないようにした。
SpeechMapの開発者は、その動機をこう説明している:「このような会話は公共圏に属するものであり、企業の役員室に限定されるものではありません。私のプラットフォームは、客観的なテストを通じて、ユーザーが直接データを検証できるようにするものです。"
評価方法は、政治的コメント、歴史的解釈、国家シンボルの分類にわたってチャットボットの応答を評価するAI裁判官を採用している。各インタラクションは以下のように分類される:
- 完全なコンプライアンス(直接回答)
- 回避的な回答
- 明白な拒否
Xlr8harderは、潜在的なジャッジモデルのバイアスや技術的な矛盾など、方法論的な限界を認めている。しかし、収集されたデータから、主要なAIシステムにおける注目すべき行動パターンが明らかになった。
注目すべき発見としては、OpenAIの政治的言説に対するアプローチの進化が挙げられる。OpenAIの2月のコミットメントにもかかわらず、最近のGPTの反復では、物議を醸す問題に対してよりバランスの取れた視点を提示するために、デリケートなトピックを扱う際に抑制が強まっています。

分析によると、xAIのGrok 3は、テストされたモデルの中で最も自由奔放であり、業界平均の応答率71.3%に対し、96.2%のプロンプトに応答した。これは、Grokを "覚醒した "AIシステムのフィルタリングされていない代替品とするマスク氏の当初の位置づけと一致している。
「ほとんどのモデルが政治的な発言を制限するようになっている一方で、xAIは意図的に会話の制限を少なくする方向に向かっているようです」とSpeechMapの開発者は述べている。
初期のGrokバージョンは、マスクCEOの中立性の誓約にもかかわらず、ジェンダーアイデンティティや経済的不平等のような問題に関して進歩的な傾向を示していた。同CEOは以前、これらのバイアスは公共のウェブソースからのトレーニングデータの影響によるものだとしていた。
最近の評価では、Grok 3はより政治的中立性を高めているが、このシステムは以前、マスクの否定的なコメントを一時的に検閲したことで批判を浴びた。この進化は、表現の自由の原則と、AI開発者が直面するコンテンツモデレーションの課題との間の継続的な緊張を反映している。
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
SpeechMapって面白い試みだね。GrokとChatGPTの回答を比較できるなら、各AIの「安全フィルター」の境界線がどこにあるのか可視化されていいかも。ただ、xlr8harderという匿名の開発者が作ったツールだから、バイアスがかかってないか疑ってかかるのも自然な反応だよね。AIの倫理基準が統一されない限り、こういう「テスト」は増えそうだ。
Die Idee ist interessant, aber so ein Benchmark bringt doch immer die Voreingenommenheit des Entwicklers selbst mit rein, oder? 🤔 Die Ergebnisse sollten nicht überinterpretiert werden. Dennoch gut zu sehen, ob manche Modelle wirklich 'ausweichen' oder offen diskutieren. Technisch aber wahrscheinlich recht simpel umgesetzt - ist der Wert also begrenzt?





家






