TAG

#マルチモーダルAI4件

#マルチモーダルAI に関連する記事を横断して確認できます。特定テーマの変化を追う入口です。

プロダクト

Google、動画生成AI「Gemini Omni 1.1 Flash」公開

Googleは、動画の生成および編集機能を備えた新しいマルチモーダルAI「Gemini Omni 1.1 Flash」を発表しました。このAIは、直前の10秒間の文脈を考慮して最大40秒の動画シーンを延長できるほか、特定フレームの指定生成にも対応しています。APIやツールを通じて利用可能となります。

ITmedia AI+
モデル

国産マルチモーダルAI基盤「FRONTia」が本格始動

経済産業省とNEDOは、国産マルチモーダルAI基盤モデル「FRONTia」の開発プロジェクトを本格始動させました。これはAIロボットやフィジカルAIへの活用を見据えたもので、都内でキックオフイベントも開催されました。

ITmedia AI+
モデル

Thinking Machinesが初のマルチモーダルAIを発表

AIスタートアップのThinking Machines Labが、初の基盤モデル「Inkling」を公開しました。この大規模なオープンソースモデルは、動画と音声の理解能力に特化して訓練されています。

WIRED AI
モデル

Meta、マルチモーダルAI『Muse Spark 1.1』と低価格API提供

Metaは、改良されたマルチモーダル推論AIモデル「Muse Spark 1.1」を発表しました。このモデルは、ツール操作や複雑なコーディングといったエージェント能力が強化されています。同時に、競合モデルより低価格で利用できる「Meta Model API」を通じて、外部開発者向けに公開されました。

ITmedia AI+