Command Palette
Search for a command to run...
Papers
最新のAIトレンドを把握するための、日々更新される最先端AI研究論文
論文

AIエージェントはオープンエンドなAI研究を遂行できるか?2つの事例研究からの初期の証拠

コードをエージェントハーネスに:実行可能、検証可能、かつ状態を保持するエージェントシステムを目指して






























CAST: ゲームソルバーをターンレベルの教師として活用するLLMエージェントの学習
CLBench-V:グラウンディングから知識獲得に至るマルチモーダル文脈学習の評価
DecoEvo: テキスト空間におけるソルバーとルーブリック生成器スキルのスコア分離型共進化
HumanCLAW: 視覚言語モデルは身体を通して行動できるか?
CoRT: トークンレベルのルーブリック誘導型方策最適化のための反実仮想リプレイ
TurboVLA: RTX 4090上で32Hz、1GB未満のVRAMで動作するリアルタイム視覚言語行動モデル
高速画像・動画生成のための並列デコーディング蒸留
和集合と差集合を関係づける最適指数の解決
誤り局所化によるテスト時スケーリング
NVIDIA-labs OO Agents: ネイティブPythonオブジェクト指向エージェント
PerceptionBench: マルチモーダル大規模言語モデルにおける原子的視覚知覚の評価
物理強化型Neural ODEにおけるホライズン選択:理論的洞察と磁束鎖交への応用
動画オブジェクト挿入とレイヤー分解のための明示的レイヤーモデリング
Transformer Transformer: 動作条件付きロボット共設計のための統一モデル
ターゲット指向データアライメントによるきめ細かな料理画像理解
証明器とソルバの検証
中間に位置するモデル:AIネイティブなリアルタイムコミュニケーションを目指して
DynamiCrafter: 動画拡散事前知識を用いたオープンドメイン画像のアニメーション化
MemoHarness: 経験から学習するエージェントハーネス
Nanbeige4.2-3B: コンパクトモデルにおけるエージェント能力の解放
方策オン型拡散蒸留における分類器フリーガイダンスの再考
StateAct: ピクセル以前のプログラム状態に基づく長期的コンピュータ操作エージェント
ロボット学習のための進捗報酬モデリング:包括的サーベイ
プロプライエタリからオープンソースへ:エージェント型検索におけるマルチエージェントプロトコル蒸留による分布ギャップの橋渡し
JarvisHub: キャンバスネイティブなマルチモーダル創造エージェントのためのオープンハーネス
Kimi K3:オープンフロンティア知能
MUSIC-JEPA: 行動から音の世界モデルを学習する
LLMは跳躍できない
LLMは進化するユーザ意図を見失う
SOAP、Muon、そしてその先へ:LLM事前学習スケールの限界への挑戦