Command Palette
Search for a command to run...
Papers
最新のAIトレンドを把握するための、日々更新される最先端AI研究論文
論文

Rep-MTL:表現レベルのタスクサリエンシーの力を解放するマルチタスク学習

ARC-Hunyuan-Video-7B:現実世界のショートビデオの構造化理解






























エージェント型強化政策最適化
仕様の自己修正:テスト時における改善を通じた文脈内報酬の悪用の軽減
PRIX:エンドツーエンド自動運転におけるロープレキシスから学ぶ計画
AIとのチャット:リアルタイムビデオ通信が人間からAIへと驚くべき転換を遂げたこと
MMBench-GUI: GUIエージェントのための階層的マルチプラットフォーム評価フレームワーク
LLM量子化の幾何学:GPTQはババイの最近接平面アルゴリズムとして
MedIQA:プロンプト駆動型医療画像品質評価のためのスケーラブルなファウンデーションモデル
OS-MAP: コンピュータを使用するエージェントは、広さと深さにおいてどのくらい進むことができるのか?
階層的な予算ポリシー最適化による適応的推論
キャプテン・シネマ:ショートムービー生成に向けて
LAPO:長さ適応型ポリシー最適化による推論効率の内面化
MUR:大規模言語モデルにおけるモーメント不確実性を用いた推論
∇NABLA:近隣適応ブロックレベルアテンション
グループシーケンスポリシーオプティマイゼーション
SafeWork-R1:AI-45法下における安全と知能の共進化
LLMsにおける知識と推論の分離:認知二重システム理論を用いた探求
Re:Form -- LLMsにおけるRLを用いたスケーラブルな形式的ソフトウェア検証における人間の事前知識の削減:Dafnyに関する予備的研究
RAVine:エージェンティック検索におけるリアリティ対応評価
一つのドメインが他のドメインを助けることは可能か? マルチドメイン推論におけるデータ中心の研究:強化学習を用いて
DesignLab:反復的な検出と修正を通じたスライドの設計
ユメ:インタラクティブな世界生成モデル
画素、パターン、しかし詩はなし:人間のように世界を見る
眼科用MLLMの構築:臨床的認知チェーン推論を用いた位置診断協働
HySafe-AI:AIシステムのためのハイブリッドセーフティアーキテクチャ分析フレームワーク:ケーススタディ
ゼブラ・コット:インタリーブドビジョン言語推論のためのデータセット
視覚言語におけるスローサイティングのためのセミオフポリシーバイアス強化学習
重要な部分をアップサンプルする:拡散トランスフォーマーのための領域適応型潜在サンプリング
メガサイエンス:サイエンス推論のためのトレーニング後データセットの限界を突き進める
ステップオーディオ2 技術報告書
文脈の限界を越えて:長期的な推論のための無意識的なつながり