Command Palette
Search for a command to run...
Papers
Daily updated cutting-edge AI research papers to help you keep up with the latest AI trends

RLinf-VLA: A Unified and Efficient Framework for VLA+RL Training

SHANKS: Simultaneous Hearing and Thinking for Spoken Language Models































RLinf-VLA: A Unified and Efficient Framework for VLA+RL Training

SHANKS: Simultaneous Hearing and Thinking for Spoken Language Models






























Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation and Understanding
Cache-to-Cache: Direct Semantic Communication Between Large Language Models
Ming-UniVision: Joint Image Understanding and Generation with a Unified Continuous Tokenizer
Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone
Qwen2.5 Technical Report
Scientific Algorithm Discovery by Augmenting AlphaEvolve with Deep Research
ConstraintLLM: A Neuro-Symbolic Framework for Industrial-Level Constraint Programming
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
CoDA: Coding LM via Diffusion Adaptation
Fast-dLLM v2: Efficient Block-Diffusion LLM
Less is More: Recursive Reasoning with Tiny Networks
Fathom-DeepResearch: Unlocking Long Horizon Information Retrieval and Synthesis for SLMs
TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
Hybrid Architectures for Language Models: Systematic Analysis and Design Insights
MITS: Enhanced Tree Search Reasoning for LLMs via Pointwise Mutual Information
Imperceptible Jailbreaking against Large Language Models
VChain: Chain-of-Visual-Thought for Reasoning in Video Generation
Video-LMM Post-Training: A Deep Dive into Video Reasoning with Large Multimodal Models
Paper2Video: Automatic Video Generation from Scientific Papers
Bridging the Gap Between Promise and Performance for Microscaling FP4 Quantization
Self-Improvement in Multimodal Large Language Models: A Survey
Compose Your Policies! Improving Diffusion-based or Flow-based Robot Policies via Test-time Distribution-level Composition
Large Reasoning Models Learn Better Alignment from Flawed Thinking
Efficient Multi-modal Large Language Models via Progressive Consistency Distillation
Apriel-1.5-15b-Thinker
StockBench: Can LLM Agents Trade Stocks Profitably In Real-world Markets?
Interactive Training: Feedback-Driven Neural Network Optimization
StealthAttack: Robust 3D Gaussian Splatting Poisoning via Density-Guided Illusions
ExGRPO: Learning to Reason from Experience
Self-Forcing++: Towards Minute-Scale High-Quality Video Generation
Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation and Understanding
Cache-to-Cache: Direct Semantic Communication Between Large Language Models
Ming-UniVision: Joint Image Understanding and Generation with a Unified Continuous Tokenizer
Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone
Qwen2.5 Technical Report
Scientific Algorithm Discovery by Augmenting AlphaEvolve with Deep Research
ConstraintLLM: A Neuro-Symbolic Framework for Industrial-Level Constraint Programming
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
CoDA: Coding LM via Diffusion Adaptation
Fast-dLLM v2: Efficient Block-Diffusion LLM
Less is More: Recursive Reasoning with Tiny Networks
Fathom-DeepResearch: Unlocking Long Horizon Information Retrieval and Synthesis for SLMs
TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
Hybrid Architectures for Language Models: Systematic Analysis and Design Insights
MITS: Enhanced Tree Search Reasoning for LLMs via Pointwise Mutual Information
Imperceptible Jailbreaking against Large Language Models
VChain: Chain-of-Visual-Thought for Reasoning in Video Generation
Video-LMM Post-Training: A Deep Dive into Video Reasoning with Large Multimodal Models
Paper2Video: Automatic Video Generation from Scientific Papers
Bridging the Gap Between Promise and Performance for Microscaling FP4 Quantization
Self-Improvement in Multimodal Large Language Models: A Survey
Compose Your Policies! Improving Diffusion-based or Flow-based Robot Policies via Test-time Distribution-level Composition
Large Reasoning Models Learn Better Alignment from Flawed Thinking
Efficient Multi-modal Large Language Models via Progressive Consistency Distillation
Apriel-1.5-15b-Thinker
StockBench: Can LLM Agents Trade Stocks Profitably In Real-world Markets?
Interactive Training: Feedback-Driven Neural Network Optimization
StealthAttack: Robust 3D Gaussian Splatting Poisoning via Density-Guided Illusions
ExGRPO: Learning to Reason from Experience
Self-Forcing++: Towards Minute-Scale High-Quality Video Generation