AI画像編集の精度向上、ビジネス活用に弾み
テキスト指示だけで画像の大域的な属性を高精度に変更しつつ背景を保持する新技術が登場した。広告・EC・ゲームなど視覚コンテンツ産業のクリエイティブ制作コスト削減に直結すると注目されている。

61 件
テキスト指示だけで画像の大域的な属性を高精度に変更しつつ背景を保持する新技術が登場した。広告・EC・ゲームなど視覚コンテンツ産業のクリエイティブ制作コスト削減に直結すると注目されている。

英国の研究チームがオーディオブックの朗読品質をAIで定量分析し、音響特徴が聴取率と統計的に有意な相関を持つことを実証した。ナレーター採用やコンテンツ推薦の高度化に道を開く成果として注目される。

大規模推論モデルを活用した話者認識技術「DramaSR-LRM」が登場した。長尺テレビドラマにおける発話の帰属精度を大幅に向上させ、映像コンテンツ産業の自動化と収益化に新たな可能性を開く。

拡散モデルの訓練効率を高める新手法「Attention Separation」が提案された。外部データへの依存を減らしながら生成品質を維持できることが示され、AI開発コストの削減に直結する可能性がある。

香港科技大学などの研究チームが開発した「WorldDirector」は、3D軌道とカメラ動作をLLMで制御し、長時間にわたって登場人物や物体の外見を維持したまま複雑な映像を自動生成できる世界モデルである。映像・広告・自動車産業に広範な影響を与える可能性がある。

マイクロソフト研究陣らが開発した「Ink3D」は、動画生成モデルを活用して極めて複雑なテクスチャを持つ3Dアセットを自動生成する技術である。EC・ゲーム・製造業における3Dコンテンツ制作コストの抜本的削減につながると期待される。

米ジョンズ・ホプキンス大などの研究チームが、最新の大規模拡散モデルの知識を軽量な旧世代モデルへ転送する「クロス空間蒸留」技術を発表。既存インフラを維持しながら生成品質を大幅に向上できると実証した。

イスラエル・米国の研究チームが、追加学習なしに360度パノラマ画像・動画を生成するAIフレームワーク「SpheRoPE」を発表した。不動産・観光・XR産業のコンテンツ制作コストを根本から変える可能性がある。

浙江大学らの研究チームが、限られた計算資源でも高精度な3D人体表現をリアルタイム生成できるAI手法「PointSplat」を発表した。ライブ配信や遠隔医療など、帯域幅制約下でのビジネス応用に道を開く成果である。

日米の研究チームが画像生成AIの学習プロセスを抜本的に刷新する手法「GEAR」を発表した。従来比最大10倍の収束速度を実現し、広告・ゲーム・医療画像など画像生成を活用する産業のコスト構造を大きく変える可能性がある。

中国科学技術大学らの研究チームが、200万件の高品質動画編集ペアを含む大規模データセット「Goku」を公開した。指示ベースの動画編集精度が最大8%向上し、映像制作・広告・EC業界のコンテンツ制作コスト削減に直結する可能性がある。

ViTベースの動画モデルに追加学習なしで組み込める表情認識フレームワーク「MiRA」が発表された。小売・金融・医療など感情データを業績指標に連動させる企業に直接影響を与える技術革新である。

中国の研究チームが発表したAI楽曲生成システム「LeVo 2」が、専門家による聴取評価で商用サービスに匹敵する品質を達成した。音楽制作コストの大幅削減と、広告・ゲーム・映像産業のコンテンツ制作工程の再編につながる可能性がある。

清華大学らの研究チームが、生成AIの推論精度を自己修正するフレームワーク「DEFAR」を発表した。学習と推論の乖離という構造的欠陥を内部信号だけで補正し、高品質な画像生成の安定性と拡張性を大幅に高める。

華南理工大学らの研究チームが、AIによる感情表現テキスト音声合成の品質を大幅に改善する「HPRO」フレームワークを発表した。コンテンツセンターや広告制作など音声を活用する産業のコスト構造を根本から変える可能性がある。

中国研究チームが開発したアップリフトモデリング新手法「CHAUN」と「RA-IPS」が、個人レベルの施策効果予測精度をQINIスコアで最大25.6%向上させた。EC・金融・通信各業界のマーケティング投資効率改善に直結する成果として注目される。

産業用広告レコメンドシステムの構造改良を自動化するAIエージェント「NOVA」が開発された。人手作業を13分の1以下に圧縮しつつGMVを最大2%超改善する成果は、eコマースや広告プラットフォーム企業に直接的な収益インパクトをもたらしうる。

インド科学院の研究チームが、追加学習不要で画像生成AIの「多様性崩壊」を抑制する技術を発表した。広告・EC・ゲーム業界における生成AI活用の費用対効果を大幅に改善する可能性がある。

物体の移動に伴う影や照明変化まで自動処理するAI画像編集技術「RoPEMover」が登場した。EC・広告・製造業のビジュアル制作コストを大幅に削減できる可能性があり、商業利用への注目が高まっている。

静止画データのみで学習しながら動画の高精度合成を実現するAI技術「SAM2Matting」が登場した。映像制作・広告・EC業界において撮影コストと編集工数の大幅削減が見込まれる。
