Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities
強化学習のQ学習において、長期的な学習の安定性と精度を向上させる「Long-Horizon Q-learning (LQL)」が…
AI&Tech、もう追いかけなくていい。
30秒で読めるニュースダイジェスト
強化学習のQ学習において、長期的な学習の安定性と精度を向上させる「Long-Horizon Q-learning (LQL)」が…
JDがLLMの推論能力を向上させる新手法「AGPO」を発表しました。
化学論文の分子構造図を機械可読形式に変換するOCSRの新たな評価ベンチマークが発表されました。
大気質予測モデルの現実的な評価を可能にするグローバルベンチマーク「AirQualityBench」が発表されました…
AIエージェントが協調してタスクを達成するための新しい通信フレームワーク「SANEmerg」が発表されました。
XDecomposerは、X線回折データから未知の複数物質を自動で分離・特定するAIフレームワークです。
インターネット・オブ・バリュー(IoV)における複合的なリスクを評価するAIエージェントのアーキテクチャ…
MLLMから特定の視覚情報を効率的に忘れさせる新しいアンラーニング手法が提案されました。
DNA言語モデル「Wisteria」が、局所的特徴と広域的依存関係を統合した新しい学習フレームワークを提案しま…
AIを活用した数学的発見における人間とAIの協調的な作業フロー「インテントメイキング」が提唱されました。
セマンティックウェブにおける低リソース言語を定義する新しい分析手法が提案されました。
低リソース言語のデジタル表現を改善するため、知識グラフを活用した研究提案が発表されました。