Command Palette
Search for a command to run...
Papers
Daily updated cutting-edge AI research papers to help you keep up with the latest AI trends

The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping

QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation































The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping

QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation






























ELT: Elastic Looped Transformers for Visual Generation
ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion
Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory
EXAONE 4.5 Technical Report
RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details
FORGE:Fine-grained Multimodal Evaluation for Manufacturing Scenarios
WildDet3D: Scaling Promptable 3D Detection in the Wild
Autoreason: Self-Refinement That Knows When to Stop
ActiveGlasses: Learning Manipulation with Active Vision from Ego-centric Human Demonstration
MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping
When Numbers Speak: Aligning Textual Numerals and Visual Instances in Text-to-Video Diffusion Models
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
ClawBench: Can AI Agents Complete Everyday Online Tasks?
Rethinking Generalization in Reasoning SFT: A Conditional Analysis on Optimization, Data, and Model Capability
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
MDPBench: A Benchmark for Multilingual Document Parsing in Real-World Scenarios
TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders
INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling
FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching
MARS: Enabling Autoregressive Models Multi-Token Generation
Think in Strokes, Not Pixels: Process-Driven Image Generation via Interleaved Reasoning
RAGEN-2: Reasoning Collapse in Agentic RL
Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervision
ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement
ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation
Learning to Retrieve from Agent Trajectories
Claw-Eval: Toward Trustworthy Evaluation of Autonomous Agents
Video-MME-v2: Towards the Next Stage in Benchmarks for Comprehensive Video Understanding
GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning
LIBERO-Para: A Diagnostic Benchmark and Metrics for Paraphrase Robustness in VLA Models
ELT: Elastic Looped Transformers for Visual Generation
ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion
Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory
EXAONE 4.5 Technical Report
RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details
FORGE:Fine-grained Multimodal Evaluation for Manufacturing Scenarios
WildDet3D: Scaling Promptable 3D Detection in the Wild
Autoreason: Self-Refinement That Knows When to Stop
ActiveGlasses: Learning Manipulation with Active Vision from Ego-centric Human Demonstration
MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping
When Numbers Speak: Aligning Textual Numerals and Visual Instances in Text-to-Video Diffusion Models
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
ClawBench: Can AI Agents Complete Everyday Online Tasks?
Rethinking Generalization in Reasoning SFT: A Conditional Analysis on Optimization, Data, and Model Capability
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
MDPBench: A Benchmark for Multilingual Document Parsing in Real-World Scenarios
TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders
INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling
FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching
MARS: Enabling Autoregressive Models Multi-Token Generation
Think in Strokes, Not Pixels: Process-Driven Image Generation via Interleaved Reasoning
RAGEN-2: Reasoning Collapse in Agentic RL
Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervision
ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement
ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation
Learning to Retrieve from Agent Trajectories
Claw-Eval: Toward Trustworthy Evaluation of Autonomous Agents
Video-MME-v2: Towards the Next Stage in Benchmarks for Comprehensive Video Understanding
GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning
LIBERO-Para: A Diagnostic Benchmark and Metrics for Paraphrase Robustness in VLA Models