Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten
Papers

Von der Fehlerhaftigkeit zur Meisterschaft: Generierung schwieriger Beispiele für Werkzeugnutzungs-Agenten

Choreographie einer Welt dynamischer Objekte






























Klear: Einheitliche multimodale Aufgaben-Generierung für Audio-Video
Atlas: Orchestrierung heterogener Modelle und Werkzeuge für komplexes, mehrdomänenübergreifendes Reasoning
Benchmark^2: Systematische Bewertung von LLM-Benchmarks
MindWatcher: Ein Schritt hin zu intelligenter multimodaler, werkzeugintegrierter Reasoning
Entropy-adaptives Feintuning: Lösung von Selbstsicherheitskonflikten zur Minderung des Vergessens
Vielfalt oder Präzision? Ein tiefgehender Einblick in die Vorhersage des nächsten Tokens
Confucius-Code-Agent: Skalierbare Agenten-Struktur für reale Codebasen
DreamStyle: Ein einheitlicher Rahmen für die Video-Stilisierung
UniCorn: Hin zum selbstverbessernden, einheitlichen multimodalen Modellen durch selbstgenerierte Supervision
LTX-2: Effizientes gemeinsames Audio-Visual-Grundmodell
SciEvalKit: Ein Open-Source-Evaluierungstoolkit für wissenschaftliche allgemeine Intelligenz
MOSS Transkribieren Diarisieren: Genauere Transkription mit Sprecherdiarisierung
InfiniDepth: Beliebig hohe Auflösung und fein granulierte Tiefenschätzung mit neuronalen impliziten Feldern
Anpassung von agentenbasiertem KI
Großer Video-Planer ermöglicht verallgemeinerbare Robotersteuerung
InfiniteVGGT: Visual Geometry Grounded Transformer für endlose Datenströme
GARDO: Verbesserung von Diffusionsmodellen ohne Reward Hacking
VAR RL richtig gemacht: Umgang mit asynchronen Polizkonflikten in visuellen autoregressiven Generierungen
DreamID-V: Brückenbildung zwischen Bild- und Videobereich für hochauflösende Gesichtsaustauschverfahren mittels Diffusion Transformer
NextFlow: Unified Sequential Modeling aktiviert multimodales Verständnis und Generierung
K-EXAONE Technischer Bericht
Der Hunger-Spiel-Debatte: Zur Entstehung von Über-Konkurrenz in Multi-Agenten-Systemen
Training von KI-Ko-Wissenschaftlern mit Hilfe von Bewertungsrasterbelohnungen
AdaGaR: Adaptive Gabor Representation for Dynamic Scene Reconstruction
Zähmung von Halluzinationen: Steigerung des Videoverstehens durch Gegenfaktische Videoerzeugung
SenseNova-MARS: Stärkung multimodaler agenter Schlussfolgerung und Suche durch Verstärkungslernen
Avatar Forcing: Echtzeit-Interaktive Kopf-Avatar-Erzeugung für natürliche Gespräche
NeoVerse: Verbesserung des 4D-Weltmodells mit in-the-wild monokularen Videos
Youtu-Agent: Skalierung der Agentenproduktivität durch automatisierte Generierung und hybride Politikoptimierung
IQuest-Coder-V1 Technischer Bericht