Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten

Stimmevaluation der Schlussfolgerungsfähigkeit: Diagnose der modalitybedingten Leistungsunterschiede

MarsRL: Weiterentwicklung von Multi-Agenten-Reasoning-Systemen durch Verstärkendes Lernen mit agentenbasiertem Pipelinengleichlauf































Stimmevaluation der Schlussfolgerungsfähigkeit: Diagnose der modalitybedingten Leistungsunterschiede

MarsRL: Weiterentwicklung von Multi-Agenten-Reasoning-Systemen durch Verstärkendes Lernen mit agentenbasiertem Pipelinengleichlauf






























Virtuelle Breiten-Netzwerke
AIonopedia: ein LLM-Agent, der multimodales Lernen für die Entdeckung ionischer Flüssigkeiten orchestriert
UI2CodeextN: Ein visuelles Sprachmodell für skalierbare interaktive UI-zu-Code-Generierung bei Testzeit
GGBench: Ein geometrisches generatives Schlussfolgerungsbenchmark für einheitliche multimodale Modelle
WEAVE: Freisetzen und Benchmarken des kontextuellen abwechselnden Verständnisses und Generierens
DoPE: Denoising Rotary Position Embedding
BRFL: Ein blockchainbasiertes byzantinisch robustes federiertes Lernmodell
Mehrgitter-Verteilungsmodellierung für die Vorhersage der Videobetrachtungsdauer mittels Exponential-Gauß-Mischungsnetzwerk
SAC-Flow: stichproben-effizientes Verstärkungslernen von flussbasierten Politiken durch geschwindigkeitsreparametrisierte sequenzielle Modellierung
Angriffe durch Gegnerische Störungen auf geschlossene MLLMs mittels optimaler Merkmalsausrichtung
Hail to the Thief: Untersuchung von Angriffen und Abwehrmaßnahmen bei dezentralisiertem GRPO
Black-Box On-Policy Distillation von Large Language Models
UniVA: Universal Video Agent hin zu einer Open-Source-Nachfolge-Video-Allzweck-Agenten
PAN: Ein Weltmodell für allgemeine, interaktive und langfristige Welt-Simulation
Ein kleiner Schritt in der Latenten, ein riesiger Sprung für Pixel: Schneller Latent-Up-Scaling-Adapter für Ihre Diffusionsmodelle
YOLOv13: Echtzeit-Objekterkennung mit hypergraphenverstärkter adaptiver visueller Wahrnehmung
MonkeyOCR: Dokumentenparsung mit einem Struktur-Erkennungs-Beziehung-Tripel-Paradigma
Konsensbasierte Stichprobentechnik für sicherere generative KI
Argus: ein resilienceorientierter Sicherheitsversicherungsrahmen für end-to-end-ADSs
WMPO: Weltmodellbasierte Politikoptimierung für visuelle-Sprache-Aktions-Modelle
LoopTool: Schließen der Datenausbildungsschleife für robuste LLM-Toolaufrufe
Jenseits der Faktenabfrage: Episodisches Gedächtnis für RAG mit generativen semantischen Workspaces
TiDAR: Denken Sie in Diffusion, sprechen Sie in Autoregression
Time-to-Move: Bewegungssteuerung von Videogenerierung ohne Training durch dualen Uhrzeit-Rauschunterdrückung
Lumine: Ein offenes Rezept zur Entwicklung generalisierter Agenten in 3D-Offenwelten
Erzeugen eines Bildes aus 1.000 Wörtern: Verbesserung von Text-zu-Bild mit strukturierten Captions
KLASS: KL-gesteuerte schnelle Inferenz in maskierten Diffusionsmodellen
Befestigung von Computer-Verwendungs-Agenten an menschliche Demonstrationen
Wasm: Eine Pipeline zur Erstellung strukturierter arabischer gemischter multimodaler Korpora
Adaptive Multi-Agent Response Refinement in Conversational Systems
Virtuelle Breiten-Netzwerke
AIonopedia: ein LLM-Agent, der multimodales Lernen für die Entdeckung ionischer Flüssigkeiten orchestriert
UI2CodeextN: Ein visuelles Sprachmodell für skalierbare interaktive UI-zu-Code-Generierung bei Testzeit
GGBench: Ein geometrisches generatives Schlussfolgerungsbenchmark für einheitliche multimodale Modelle
WEAVE: Freisetzen und Benchmarken des kontextuellen abwechselnden Verständnisses und Generierens
DoPE: Denoising Rotary Position Embedding
BRFL: Ein blockchainbasiertes byzantinisch robustes federiertes Lernmodell
Mehrgitter-Verteilungsmodellierung für die Vorhersage der Videobetrachtungsdauer mittels Exponential-Gauß-Mischungsnetzwerk
SAC-Flow: stichproben-effizientes Verstärkungslernen von flussbasierten Politiken durch geschwindigkeitsreparametrisierte sequenzielle Modellierung
Angriffe durch Gegnerische Störungen auf geschlossene MLLMs mittels optimaler Merkmalsausrichtung
Hail to the Thief: Untersuchung von Angriffen und Abwehrmaßnahmen bei dezentralisiertem GRPO
Black-Box On-Policy Distillation von Large Language Models
UniVA: Universal Video Agent hin zu einer Open-Source-Nachfolge-Video-Allzweck-Agenten
PAN: Ein Weltmodell für allgemeine, interaktive und langfristige Welt-Simulation
Ein kleiner Schritt in der Latenten, ein riesiger Sprung für Pixel: Schneller Latent-Up-Scaling-Adapter für Ihre Diffusionsmodelle
YOLOv13: Echtzeit-Objekterkennung mit hypergraphenverstärkter adaptiver visueller Wahrnehmung
MonkeyOCR: Dokumentenparsung mit einem Struktur-Erkennungs-Beziehung-Tripel-Paradigma
Konsensbasierte Stichprobentechnik für sicherere generative KI
Argus: ein resilienceorientierter Sicherheitsversicherungsrahmen für end-to-end-ADSs
WMPO: Weltmodellbasierte Politikoptimierung für visuelle-Sprache-Aktions-Modelle
LoopTool: Schließen der Datenausbildungsschleife für robuste LLM-Toolaufrufe
Jenseits der Faktenabfrage: Episodisches Gedächtnis für RAG mit generativen semantischen Workspaces
TiDAR: Denken Sie in Diffusion, sprechen Sie in Autoregression
Time-to-Move: Bewegungssteuerung von Videogenerierung ohne Training durch dualen Uhrzeit-Rauschunterdrückung
Lumine: Ein offenes Rezept zur Entwicklung generalisierter Agenten in 3D-Offenwelten
Erzeugen eines Bildes aus 1.000 Wörtern: Verbesserung von Text-zu-Bild mit strukturierten Captions
KLASS: KL-gesteuerte schnelle Inferenz in maskierten Diffusionsmodellen
Befestigung von Computer-Verwendungs-Agenten an menschliche Demonstrationen
Wasm: Eine Pipeline zur Erstellung strukturierter arabischer gemischter multimodaler Korpora
Adaptive Multi-Agent Response Refinement in Conversational Systems