Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten
Papers

R-4B: Anreizung einer allgemeinen Auto-Denkfähigkeit in MLLMs durch zweistufige Annealing- und Verstärkungslernverfahren

Anfachen kreativen Schreibens in kleinen Sprachmodellen: LLM-as-a-Judge im Vergleich zu mehragentenbasierten verfeinerten Belohnungen






























TMUAD: Verbesserung logischer Fähigkeiten in einheitlichen Anomalieerkennungsmodellen mit einem Text-Speicherbank
Analyse der Denkketten-Dynamik: Aktive Steuerung oder untreue nachträgliche Rationalisierung?
AWorld: Die Koordination des Trainingsrezepts für agente AI
MCP-Bench: Benchmark-Tool für das Verwenden von LLM-Agenten mit komplexen Aufgaben aus der realen Welt über MCP-Server
rStar2-Agent: Technischer Bericht zur agentenbasierten Schlussfolgerung
Pref-GRPO: Paarweiser Präferenz-Reward-basierter GRPO für stabiles Text-zu-Bild-Reinforcement-Learning
MobileCLIP2: Verbesserung des multimodalen verstärkten Trainings
KI-KI-Ästhetische Zusammenarbeit mit expliziter semiotischer Bewusstheit und emergenter Grammatikentwicklung
In das Herz blicken: Ein Multiview-Video-Datensatz für die rPPG- und Gesundheitsbiomarker-Schätzung
Die Vorhersage der Reihenfolge kommender Tokens verbessert die Sprachmodellierung
MIDAS: Multimodale interaktive digitale Mensch-Synthese durch Echtzeit-Autoregressive Videogenerierung
Diskrete Diffusions-VLA: Einbringen diskreter Diffusion in die Aktionstdekodierung von visuell-sprachlich-handelnden Politiken
Selbstbelohnender visuell-sprachlicher Modellierungsansatz durch Reasoning-Dekomposition
Jenseits der Transkription: Mechanistische Interpretierbarkeit in der Spracherkennung
CODA: Koordination von Großhirn und Kleinhirn für einen Dual-Brain-Computer-Nutzungs-Agenten mit entkoppelter Verstärkungslernung
WebSight: Eine vision-first-Architektur für robuste Web-Agenten
UltraMemV2: Speicher-Netzwerke mit Skalierung auf 120B Parameter und überlegener Lernleistung für lange Kontexte
Technischer Bericht von Hermes 4
OmniHuman-1.5: Verleihen eines aktiven Geistes an Avatare durch kognitive Simulation
VoxHammer: trainingsfreie präzise und kohärente 3D-Editierung im nativen 3D-Raum
CMPhysBench: Ein Benchmark zur Bewertung großer Sprachmodelle in der Festkörperphysik
TreePO: Brücke zwischen Policy-Optimierung und Wirksamkeit sowie Inferenzeffizienz durch heuristische baumbasierte Modellierung
Nemotron-CC-Math: Ein hochwertiger Vortrainingsdatensatz für Mathematik mit Skalierung auf 133 Milliarden Token
Verständniswerkzeug-integriertes Schließen
Spacer: Hin zu künstlich gestalteter wissenschaftlicher Inspiration
Jenseits der Wiederholung: Verlängerung der Rekursionstiefe durch Rekurrenz, Gedächtnis und Skalierung der Rechenleistung zur Prüfungszeit
VibeVoice Technischer Bericht
MMTok: Multimodale Abdeckungsoptimierung für eine effiziente Inferenz von VLMs
MV-RAG: Retrievalgestützte multiview-Diffusionsmethode
Verbindung der Synthese von metallorganischen Gerüsten mit Anwendungen mittels multimodaler maschineller Lernverfahren