AI×経営戦略9/28(月)PoEM、AI再学習なしで挙動予測MITなどの研究チームが、既存の強化学習済みモデル群から新たな報酬関数向けの学習結果を追加学習なしに予測する手法「PoEM」を提案した。生成AI開発における再学習コストの圧縮と迅速な報酬設計の検証を可能にする。
AI×経営戦略7/3(金)LLM強化学習、1層訓練で全体に匹敵米ミネソタ大学などの研究チームが、大規模言語モデルの強化学習後処理において単一のTransformer層を訓練するだけで全パラメータ更新と同等の性能を達成できることを実証した。AI開発コストの大幅削減につながる知見として注目される。