Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten
Papers

MUSE-Autoskill: Selbstentwickelnde Agenten durch Fertigkeitserstellung, Gedächtnis, Management und Evaluation

Nemotron 3 Ultra: Open-Source, effizientes Mixture-of-Experts-Hybridmodell aus Mamba und Transformer für agentic reasoning






























Qwen-Image-Flash: Jenseits des objektiven Designs
OVO-S-Bench: Ein hierarchisches Benchmark für Streaming-Raumintelligenz in multimodalen LLMs
Reproduktion, Analyse und Detektion von Reward Hacking in rubrikbasiertem Verstärkungslernen
Wo gehen Deep-Research-Agents falsch? Span-Ebene-Fehlerlokalisierung in Agent-Trajektorien
Audio-Interaktionsmodell
Cosmos 3: Omnimodale Weltmodelle für physische KI
Lernen, schnell und langsam: Auf dem Weg zu LLMs, die sich kontinuierlich anpassen
LEAP: Beschleunigung von LLMs für formale Mathematik mit agentic frameworks
Weltmodelle treffen auf Sprachmodelle: Zur Komplementarität von konkretem und abstraktem Denken
Von Aktivierung zu Kausalität: Entdeckung kausaler visueller Repräsentationen im menschlichen Gehirn
Eine lokale Störungstheorie für domänenübergreifende Interferenz und Wiederherstellung in Multi-Domain-RL
Humanoid-GPT: Skalierung von Daten und Struktur für Zero-Shot-Bewegungsverfolgung
Vertrauensbereich On-Policy Distillation
OCC-RAG: Optimaler kognitiver Kern für treue Fragenbeantwortung
MAI-Thinking-1: Entwicklung einer Hill-Climbing-Maschine
VLM3: Visuell-Sprachmodelle sind nativ 3D-Lerner
Harness-1: Verstärkungslernen für Suchagenten mit zustandsauslagernden Harnesses
DeepCrack: Eine tiefe hierarchische Merkmalslernalchitektur zur Segmentierung von Rissen
VideoMLA: Niedrigrangiger Latenter KV-Cache für Minuten-Skalen-Autoregressive Video-Diffusion
Draft-OPD: On-Policy Distillation für spekulative Entwurfsmodelle
K-BrowseComp: Ein Web-Browsing-Agent-Benchmark, der in koreanischen Kontexten verankert ist
Eine Frage des TASTE: Verbesserung der Abdeckung und Schwierigkeit von Agent Benchmarks
Über die Skalierung von PEFT: Hin zu Millionen persönlicher Modelle mit Billionen Parametern
Crafter: Ein Multi-Agent-Rahmenwerk zur Generierung bearbeitbarer wissenschaftlicher Abbildungen aus vielfältigen Eingaben
TACK: Eine statistische Evaluierung der Degradationsaktivität auf einem neuartigen TArgeting Chimeras Knowledge-Datensatz
Narrativer Webstuhl: Auf dem Weg zu einer kontrollierbaren langfristigen visuellen Konsistenz mit multimodaler Konditionierung
Das Aktualisieren von Harness ist nicht der Nutzen von Harness: Entkopplung der Evolutionsfähigkeiten in selbstentwickelnden LLM-Agenten
LongTraceRL: Lernen von Langkontext-Reasoning aus Such-Agent-Trajektorien mit Rubrik-Belohnungen
Vertrauensbereichs-Verhaltensmischung für On-Policy-Distillation
SwanVoice: Ausdrucksstarke Langform-Zero-Shot-Sprachsynthese für sowohl Monolog als auch Dialog