Command Palette
Search for a command to run...
Papers
最新のAIトレンドを把握するための、日々更新される最先端AI研究論文
論文

StateAct: ピクセル以前のプログラム状態に基づく長期的コンピュータ操作エージェント

ロボット学習のための進捗報酬モデリング:包括的サーベイ






























プロプライエタリからオープンソースへ:エージェント型検索におけるマルチエージェントプロトコル蒸留による分布ギャップの橋渡し
JarvisHub: キャンバスネイティブなマルチモーダル創造エージェントのためのオープンハーネス
Kimi K3:オープンフロンティア知能
MUSIC-JEPA: 行動から音の世界モデルを学習する
LLMは跳躍できない
LLMは進化するユーザ意図を見失う
SOAP、Muon、そしてその先へ:LLM事前学習スケールの限界への挑戦
高速画像生成のための改良型分布マッチング蒸留
生成モデリングのための三体散乱
ネイティブマルチモーダル事前学習のスクラッチからのスケーリング
DataPrep-Bench: 訓練データ作成器としてのLLMのベンチマーク評価
Molt: エージェント型強化学習のためのスケーラブルなPyTorchネイティブ学習フレームワーク
エージェンティック・コンテキスト管理:エージェントの記憶とコストをライフサイクルとアーキテクチャの問題として解決する
Skill Self-Play: 共進化するスキルによるLLM能力のフロンティア開拓
より優れたハーネス、より小さなモデル:自動ハーネス適応による90%コスト削減エージェントの構築
記憶から技能へ:長期稼働LLMエージェントのための証拠に基づく共進化ガバナンス
文脈重み付き離散フローマッチング
SANA-Video 2.0: 効率的な動画生成のための注意残差を用いたハイブリッド線形注意機構
語るのではなく示せ:LLMテキストではなく生成的ピクセルにおける空間認知の評価
視覚的対照自己蒸留
ReferTrack:参照してから追跡する身体化視覚追跡
K12-KGraph: 教育用大規模言語モデルのベンチマーク評価と訓練のためのカリキュラム整合型知識グラフ
AREX: 深層リサーチのための再帰的自己改善エージェントを目指して
ユークリッドクリッピングを超えて:リーマン等長方策最適化によるLLM強化学習における探索崩壊の克服
大規模言語モデルにおけるハイパーネットワークに基づく知識注入のスケーリング則
能動的観察者のための試験
関連性中心の検索を超えて:ルーブリック指向の文書セット選択とランキング
Self Gradient Forcing: ネイティブな長尺動画補外
SLAI T-Rex: Ascend SuperPOD上でのDeepSeek-V4ファミリーの全パラメータ事後学習
Vera: コンテンツ保存型動画編集のための階層的拡散モデル