トップページへ戻る

ニュース

HOME > ニュース > Gadgetニュース

公開日 2024/02/16 18:13
リアルだけどどこか違和感も

OpenAI、テキストからリアルな動画を生成する新AI「Sora」を発表

Munenori Taniguchi
OpenAIは「Sora」と称する新しい生成AIモデルを発表した。このAIは、入力されたテキスト文から複数のキャラクター、特定のモーションを含む、最長1分間の複雑かつフォトリアリスティックな動画を生成する。

このAIモデルは物体が「物理世界にどのように存在する」のかを理解することで、「物体の配置などを正確に解釈し、生き生きとした感情を表現する魅力的なキャラクターを生成する」ことができるとのことだ。

Soraは、テキストからの生成だけでなく、静止画から動画を生成したり、既存動画のなかで欠落した部分を埋めたり拡張したりすることもできる。OpenAIは、Soraのデモンストレーションとしてゴールドラッシュ当時のカリフォルニアをドローン撮影したような映像や、電車内から東京郊外の街並みを眺めるシーンなど、生成された動画を多数ウェブサイトで公開している。

一連の動画はいずれもリアルそのものではあるものの、少し注意してみれば、明らかにそれがAIによって生成されたとわかる描写が見つかるだろう。たとえば、博物館の動画では、床面が不自然にうねって見える(錯視のようでもあるが)。また老婦人がバースデーケーキのろうそくを吹くシーンでは、そのろうそくの火がまったく消えない。また背後で手を振る女性の指が不自然に曲がったり、その本数が増減するような場面もある。

ちなみに現在のところ、Soraを利用できるのは、潜在的な害やリスクについてモデルを評価する「レッド チーム」の担当者だけとのことだ。

さらに、一部のビジュアル アーティスト、デザイナー、映画製作者に、この新しいAIを使用してもらっているとOpenAIは述べている。また、既存のAIモデルは複雑なシーンの物理を正確にシミュレートしていない可能性があり、原因と結果の特定のインスタンスを適切に解釈できない可能性があることに注意が必要とのことだ。

ちなみに、テキストから動画を生成できるAIモデルに取り組んでいるのはOpenAIだけではない。Midjourneyは最近、テキストから動画を生み出す生成AIの開発に取り組んでいることを発表している。ただしまだ、公開予定などは明らかにされていない。Metaも「Emu Video」なるテキストtoビデオ生成AIを開発している。

Stability AIは以前、解像度576×1024px、25フレームまでの動画を生成できるStable Video Diffusionをオープンソースとして公開し話題になった。

Stability AI、「Stable Video Diffusion」発表。静止画から超ショート動画を生成

Source: Sora(OpenAI)
via: Verge

新着クローズアップ

クローズアップ

アクセスランキング RANKING
1 スピーカーセッティングを攻めろ!FYNE AUDIOの10万円ブックシェルフの使いこなしを徹底研究
2 早くもサブスク配信中!『プロジェクト・ヘイル・メアリー』『国宝』『TOKYOタクシー』はお盆休み期間にこそ観たい
3 【moraアニソンランキング】2週連続1位のKing Gnu「GO GHOST」に、『ヤニねこ』『ジャードゥーガル』『幼女戦記 II』OPテーマが続く
4 DJI「Osmo Pocket 4P」がiOSデバイスへのファイル自動転送に対応
5 サウンドピット、公認“のれん分け”ショップ「SOUNDPIT+」を名古屋・覚王山に9月オープン
6 サンワサプライ、4000円切りのANC搭載完全ワイヤレスイヤホン「400-BTTWS8」。ケース併用で最大24時間再生
7 <香港ショウ>Unique Melody、イヤホン+専用アンプのフラグシップシステム発表/DITA、Forte Earsもプロトタイプを披露
8 アキュフェーズ、新CDプレーヤー「DP-470」。独自低ノイズ化技術「ANCC」搭載などで性能強化
9 【ミニレビュー】澄んだ美しさが光る。オーディオボードのプロが作ったデスクトップ用スタンド、クリプトン「DA-SD1」
10 最高品質のレコード盤制作のために。ミキサーズ・ラボのカッティングスタジオにエソテリック「Grandioso N1」を導入!
8/13 11:08 更新

WEB