Command Palette
Search for a command to run...
Papers
最新のAIトレンドを把握するための、日々更新される最先端AI研究論文
論文

SHANKS:音声言語モデルにおける同時聴取と思考

Lumina-DiMOO:マルチモーダル生成および理解を目的としたオムニ拡散大規模言語モデル






























キャッシュ間通信:大規模言語モデル間の直接的な意味通信
Ming-UniVision:統一連続トークナイザーを用いた画像理解と生成の統合
Phi-3 技術レポート:あなたのスマートフォン上でローカルに実行可能な高機能な言語モデル
Qwen2.5 技術報告
ディープリサーチを組み込んだAlphaEvolveによる科学的アルゴリズムの発見
ConstraintLLM:産業レベルの制約プログラミングのためのニューロ・シンボリック枠組み
コード支援付きチェーン・オブ・シンキングおよび指示のスケーリングによるモデル推論
CoDA:拡散適応を用いたLMのコーディング
Fast-dLLM v2:効率的なブロックディフュージョン型LLM
少ないことがむしろ多い:小さなネットワークを用いた再帰的推論
Fathom-DeepResearch:SLM向けの長期視野情報検索および統合の可能性を解き放つ
TaTToo:テーブル推論におけるテスト時スケーリングのためのツール接地型思考PRM
言語モデル向けハイブリッドアーキテクチャ:体系的分析と設計の知見
MITS:ポイントワイズ相互情報量を用いたツリー探索推論によるLLMの性能向上
大規模言語モデルに対する認識不能な改ざん
VChain:動画生成における推論のための視覚的思考の連鎖
ビデオ-LMM ポストトレーニング:大規模マルチモーダルモデルを用いたビデオ推論の深層分析
Paper2Video:科学論文からの自動動画生成
マイクロスケーリングFP4量子化における「約束」と「実績」の乖離を埋める
マルチモーダル大規模言語モデルにおける自己改善:サーベイ
ポリシーを構成せよ!テスト時における分布レベルの組み合わせによる拡散型またはフロー型ロボットポリシーの改善
大きな推論モデルは、不完全な思考からより良い整合性を学習する
プログレッシブ一貫性蒸留を用いた効率的なマルチモーダル大規模言語モデル
アプリエル-1.5-15b-シンカー
StockBench:大規模言語モデルエージェントは現実の市場で株式を利益を上げて取引できるか?
インタラクティブなトレーニング:フィードバック駆動型ニューラルネットワーク最適化
StealthAttack:密度誘導幻覚を用いたロバストな3Dガウススプラッティング汚染手法
ExGRPO:経験から推論するための学習
Self-Forcing++:分単位スケールの高品質な動画生成へ
LongCodeZip:コード言語モデル向けの長文脈圧縮手法