TAG

#強化学習3件

#強化学習 に関連する記事を横断して確認できます。特定テーマの変化を追う入口です。

モデル

IBM Granite 4.2モデル発表、環境内で思考・行動を学習

IBMは2026年8月25日、同社初のデコーダーオンリー型推論言語モデル「Granite 4.2」ファミリーを発表しました。このモデルは3B、8B、30Bの3つのパラメータサイズで提供され、Apache 2.0ライセンスの下で公開されます。特に8Bと30Bのモデルは、実際のソフトウェアエンジニアリングやウェブ検索環境内で強化学習を実施し、切り替え可能な思考モードを搭載している点が特徴です。

Unite.AI
研究

DeepMind、15年のゲームAI研究をEVE Onlineで展開

Google DeepMindは、これまで15年間続けてきたゲームAI研究の成果を集約し、MMOゲーム「EVE Online」を開発するFenris Creationsとの戦略的パートナーシップを発表しました。この提携により、DeepMindはEVE Onlineの広大な宇宙空間を舞台に、段階的なAI研究プログラムを実施する計画です。

Unite.AI
AI活用

ソフトバンクと安川電機、強化学習でロボット性能向上を実証

ソフトバンクと安川電機は、「SoftBank World 2026」で、強化学習を活用してロボットが自己学習し、使うほど性能が向上する「フィジカルAI」の協業成果を発表しました。これは、ロボットの導入後も継続的に性能が進化する新たなパラダイムシフトの可能性を示しています。

ITmedia AI+