Command Palette
Search for a command to run...
Papers
Daily updated cutting-edge AI research papers to help you keep up with the latest AI trends

SkillOpt: Executive Strategy for Self-Evolving Agent Skills

CVEvolve: Autonomous Algorithm Discovery for Unstructured Scientific Data Processing































SkillOpt: Executive Strategy for Self-Evolving Agent Skills

CVEvolve: Autonomous Algorithm Discovery for Unstructured Scientific Data Processing






























Poly-EPO: Training Exploratory Reasoning Models
MEMO: Memory as a Model
ACC: Compiling Agent Trajectories for Long-Context Training
Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Training Steps
π-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
Perception or Prejudice: Can MLLMs Go Beyond First Impressions of Personality?
TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation
DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable Rewards
Interactive Evaluation Requires a Design Science
ESI-BENCH: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
Comparative Analysis of Military Detection Using Drone Imagery Across Multiple Visual Spectrums
Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models
Coordinated Optimal Power Quality Management in Distribution Systems Using The Residual Capacity of Community IBRs
EllipseLIO: Adaptive LiDAR Inertial Odometry with an Ellipsoid Representation
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
Detecting Trojaned DNNs via Spectral Regression Analysis
The Illusion of Thinking: Understanding the Strengths and Limitations of Reasoning Models via the Lens of Problem Complexity
Generative Recursive Reasoning
Safety Pretraining: Toward the Next Generation of Safe AI
RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards
When Vision Speaks for Sound
AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration
Process Rewards with Learned Reliability
GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
Targeted Neuron Modulation via Contrastive Pair Search
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
KVPO: ODE-Native GRPO for Autoregressive Video Alignment via KV Semantic Exploration
Code-as-Room: Generating 3D Rooms from Top-Down View Images via Agentic Code Synthesis
Poly-EPO: Training Exploratory Reasoning Models
MEMO: Memory as a Model
ACC: Compiling Agent Trajectories for Long-Context Training
Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Training Steps
π-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
Perception or Prejudice: Can MLLMs Go Beyond First Impressions of Personality?
TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation
DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable Rewards
Interactive Evaluation Requires a Design Science
ESI-BENCH: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
Comparative Analysis of Military Detection Using Drone Imagery Across Multiple Visual Spectrums
Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models
Coordinated Optimal Power Quality Management in Distribution Systems Using The Residual Capacity of Community IBRs
EllipseLIO: Adaptive LiDAR Inertial Odometry with an Ellipsoid Representation
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
Detecting Trojaned DNNs via Spectral Regression Analysis
The Illusion of Thinking: Understanding the Strengths and Limitations of Reasoning Models via the Lens of Problem Complexity
Generative Recursive Reasoning
Safety Pretraining: Toward the Next Generation of Safe AI
RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards
When Vision Speaks for Sound
AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration
Process Rewards with Learned Reliability
GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
Targeted Neuron Modulation via Contrastive Pair Search
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
KVPO: ODE-Native GRPO for Autoregressive Video Alignment via KV Semantic Exploration
Code-as-Room: Generating 3D Rooms from Top-Down View Images via Agentic Code Synthesis