OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

OpenAI が Sora をリリースし、テキストからビデオへの AI コンテンツ生成競争に参入。 Sora は、ユーザーのプロンプトに基づいて最長 1 分間のビデオを生成できます。

同社は、東京の街を歩く女性やゴールドラッシュ時代のカリフォルニアの歴史的映像など、SORAで制作した印象的なビデオをいくつか披露した。

Sora プレビューは現在、一般公開されていますが、セキュリティ専門家やクリエイターなどの特定のグループにも公開される予定です。同社は、クリエイティブな専門家にとって最も役立つモデルに進化させる方法についてのフィードバックを得るために、特定の個人にアクセスを許可しています。全体的なリリース日はまだ発表されていません。

「私たちは、誤報、憎悪コンテンツ、偏見などの分野の専門家である『レッドチーム』と協力して、このモデルに対して敵対的テストを実施しています」と同社は述べた。「また、動画がSoraによって生成されたかどうかを判断できる検出分類器など、誤解を招くコンテンツの検出に役立つツールも構築しています。」

OpenAI は、この種の技術を考案した最初の企業ではありません。 Meta、Google、その他いくつかの企業は、同様の製品の独自バージョンをリリース済み、またはリリース準備中です。市場で最も人気のあるソリューションには、Stability AI、Runway、Pika、Google Lumiere などがあります。しかし、業界アナリストは、Sora のビデオ品質はほとんどの競合他社よりも優れていると指摘しています。おそらく、それが Sora のデモが大きな話題と誇大宣伝を生み出した理由でしょう。

OpenAIによると、Soraが他のモデルより優れている点は、その驚異的なリアリティと、短いプロンプトからより長いビデオクリップを生成できる能力だ。 Sora は言語に対する深い理解に基づいており、プロンプトを理解し、キャラクターや感情を生成することができます。

Sora のデモでは、いくつかの単語からビデオを生成する機能が示されましたが、単一の画像や一連のフレームからビデオを生成する機能は示されませんでした。

Sora の発売は興奮を生んだが、懸念もいくつかあった。この技術はディープフェイクを作成し、誤った情報を広めるのに使用される可能性があります。 Sora では、不適切な実在の人物や、ポルノや暴力を含むコンテンツを作成するためにプラットフォームを使用するなど、コンテンツに対していくつかの制限が設けられると予想されます。

「誤情報の解決には、ある程度の緩和策を講じる必要がありますが、それには社会とソーシャルメディアネットワークの理解も必要です」と、DALL-Eチームの主任研究員兼リーダーであるアディティア・ラメシュ氏は述べた。

Sora に関するもう一つの懸念は、他者の著作権を侵害する可能性があることです。 OpenAI は、トレーニング データはライセンスを受けたコンテンツまたは公開されているコンテンツから取得されると主張していますが、何が「公開されている」かについては常に曖昧さが残ります。 OpenAI がこの問題を解決できない場合、多くの訴訟に直面する可能性があります。

Sora には、複雑なシーンの物理を正確にシミュレートする上でもいくつか問題があります。たとえば、キュ​​ーの空間的な詳細がわかりにくくなる可能性があります。

Sora は、一般ユーザーにテキストを使用した AI 搭載ビデオを作成する機能を提供します。テキストからビデオへの変換技術が映画やテレビ番組の制作業界を脅かすまでにはまだまだ長い道のりがありますが、エンターテインメント業界に大きな混乱をもたらす可能性もあります。

現時点では、OpenAI はそこまで先のことを考えていません。同社は、不適切なコンテンツや誤情報を拒否し、C2PAガイドラインに従ってSoraが制作した動画にラベルを付けるなど、プラットフォームの基本的な安全機能の向上に注力する。(C2PAは、出版社や企業などがメディアにメタデータを埋め込んで、その出所や関連情報を検証できるようにするオープンな技術標準である。C2PAはAI生成画像だけでなく、カメラメーカーや報道機関などもメディアコンテンツの出所や履歴、出所を証明するために同じ標準を採用している。)

<<:  1024解像度で最速モデル、ByteDanceのオープンモデルSDXL-Lightningがリリース

>>:  顔認識は終わったのか?最初の「顔ハイジャック」型バンキングトロイの木馬が誕生

ブログ    

推薦する

人工知能の時代にはどんな教師が必要なのでしょうか?

「私の仕事はロボットに置き換えられるのでしょうか?」人工知能の急速な発展により、ますます多くの人々...

このレビューでは、5年間にわたる89の研究を数え、ディープラーニングにおけるコードデータ拡張がどのように進んでいるかを示しています。

今日のディープラーニングと大規模モデルの急速な発展により、革新的なテクノロジーの絶え間ない追求がもた...

...

3つの主要な要因の影響を受けて、自動運転トラックの開発は加速し続けています

近年、自動運転は幅広い注目を集め、熱い議論を呼んでいます。自動運転は自動車産業の将来のトレンドである...

...

大規模モデルの最大のバグは、正解率がほぼゼロであり、GPTからLlamaまで誰も免れないことです。

GPT-3とLlamaに「AはBである」という単純な知識を教え、​​次にBが何であるかを尋ねました...

...

掃除ロボットに抜け穴がある!あるいは数秒で盗聴ツールに変わる可能性もある

先日、陝西省西安市は「サイバーセキュリティは人々のためのものであり、サイバーセキュリティは人々に依存...

馬懿、沈向陽、曹英の最新AIレビューが人気に!作成に3か月かかりました。ネットユーザー必読の論文です

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

OpenAIがついにオープン:DALL-E 3の論文が発表され、ChatGPTが開始、著者の半数が中国人

最後に、「OpenAI は再びオープンになりました。」 OpenAIが発表したばかりのDALL・E ...

ボストン・ダイナミクスCEO:軍の命令は否定しないが、ロボット犬を粗雑に扱っていると思う

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

オーディオ品質評価方法の簡単な分析

パート01 評価方法オーディオ品質の評価に関しては、オーディオの品質を完全に理解するために、主観的評...

人工知能によりデータセンターのコストと制御ニーズが増加

人工知能 (AI) はコンピューティングとデータ分析の世界を変えています。機械学習、自然言語処理、コ...

機械学習に必要な5つのスキル

機械学習、かっこいいですね。名前からすると、ロボットが一列に並んで座って知識を学習しているように思わ...

...