Microsoft は最近、AI 駆動型コンテンツ モデレーション システムを監査し、AI モデルの潜在的なエラーを指摘するテストを自動的に作成するように設計されたいくつかのツールとデータセットのオープン ソースを発表しました。 Microsoft によれば、AdaTest および (De)ToxiGen プロジェクトにより、人間レベルの複雑さを持つテキストを分析および生成するための、より信頼性の高い大規模言語モデル (LLM)、または OpenAI の GPT-3 に類似したモデルが作成できる可能性があるという。 現在、LLM には多くのリスクが伴います。これらのモデルはインターネット(ソーシャル メディアを含む)からの大量のデータを使用してトレーニングされるため、トレーニング中に有害なテキストに遭遇する可能性があります。モデルの再トレーニングにかかるコストと、存在するエラーの数が多いため、これらのモデルの欠陥を見つけて修正することは依然として困難です。 有害性の問題に対処するため、Microsoft Research チームは、有害な言語にフラグを立てるために使用できるコンテンツ モデレーション ツールをトレーニングするためのデータセットである ToxiGen を開発しました。 Microsoft によれば、ToxiGen には「中立的」および「有害」な発言の例が 274,000 件含まれており、公開されているヘイトスピーチのデータセットとしては最大規模のものの 1 つとなっている。 Ece Kamar ToxiGen、Microsoft Research のパートナー リサーチ エリア マネージャー、AdaTest および (De)ToxiGen のプロジェクト リーダー いかなるコンテンツ モデレーション システムにも欠陥があり、これらのモデルは継続的に改善する必要があることを私たちは認識しています。 (De)ToxiGen の目標は、AI システムの開発者が既存のコンテンツ モデレーション テクノロジーのリスクや問題をより効果的に特定できるようにすることです。 私たちの実験では、このツールは多くの既存のシステムをテストするために使用できることが示されており、このツールの恩恵を受ける新しい環境についてコミュニティから学ぶことを楽しみにしています。 サンプルを生成するために、Microsoft Research チームは、黒人、身体および認知障害を持つ人々、イスラム教徒、アジア人、ラテン系アメリカ人、LGBTQ+、ネイティブ アメリカンを含む 13 の少数派グループを対象とした「中立的な」発言とヘイトスピーチの LLM サンプルを提供しました。これらの記述は、既存のデータセットのほか、ニュース記事、意見記事、ポッドキャストのトランスクリプト、その他の同様の公開テキスト ソースから抽出されています。 Microsoft チームは、ToxiGen ステートメントを作成するために使用されるプロセスは (De)ToxiGen と呼ばれ、LLM 生成ツールが誤って識別される可能性のあるステートメントを生成するように誘導することで、特定の監査ツールの弱点を明らかにするように設計されていると説明しました。チームは、手動でキュレーションされた 3 つの毒性データセットの研究を通じて、1 つのツールから始めて ToxiGen を使用して微調整すると、ツールのパフォーマンスが「大幅に」向上することを発見しました。 Microsoft チームは、ToxiGen の作成に使用された戦略を他の領域に拡張して、より「微妙な」かつ「豊富な」中立的およびヘイトスピーチの例を作成できると考えています。しかし専門家は、これは万能薬ではないと警告している。 |
<<: Natureサブジャーナル:ニューロモルフィックコンピューティングがさらに進歩し、科学者はニューロンとシナプスの人工シミュレーションを実現した
[[246868]]スマートヘルスケアの分野における最近のニュースを振り返ると、大手企業は絶えず行動...
絶えず変化するビジネス環境において、データは驚くべき速度で増加しています。データの急増により、あらゆ...
今週の金曜日、待望の NVIDIA 奨学金の受賞者リストが発表されました。 NVIDIA 大学院フェ...
[原文は51CTO.comより] 最近、AI分野のブラックテクノロジーは、人々の人工知能に対する認識...
わが国のアルゴリズム推奨政策は明確に実施されており、アルゴリズム差別、「ビッグデータによる旧顧客殺し...
既存企業は、クラウド コンピューティングの導入を検討する際、ジレンマに直面します。メリットは魅力的か...
自動化システムでは、ディープラーニングとコンピュータービジョンが広く普及し、あらゆる場所で利用されて...
人工知能は、今日の商業不動産業界において非常に重要な破壊的変化をもたらします。すべての兆候から判断す...
パートナーシップ、会社登録、資金調達なしで、独立系開発者の Li Xiaoyu は継続的に実践と反復...
この記事では、ディープラーニングでよく使用される 8 種類の畳み込みについてまとめ、非常に鮮明な方法...
[[399295]]この記事はWeChatのパブリックアカウント「Python Society」から...
本稿では、トポロジカルデータ分析 (TDA) の基本原理を紹介し、事例を示し、この方法が視覚分析を効...
近年、我が国のドローン産業は急速な発展を遂げています。飛行制御、ナビゲーション、通信、センシングなど...