Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten
Papers

MMaDA-Parallel: Multimodale große Diffusions-Sprachmodelle für den denkbewussten Editier- und Generierungsprozess

TiViBench: Benchmarking Think-in-Video Reasoning für Video-Generative Models






























Part-X-MLLM: partenbewusstes 3D-multimodales Großsprachmodell
Uni-MoE-2.0-Omni: Skalierung sprachzentrierter omnimodaler großer Modelle mit fortgeschrittenem MoE, Training und Daten
P1: Physik-Olympiaden mit Reinforcement Learning meistern
Lancelot: Hin zu effizienten und Datenschutz-freundlichen byzantinisch-resilienten verteilten Lernverfahren innerhalb der vollständig homomorphen Verschlüsselung
Latentes Diffusionsmodell ohne Variationalen Autoencoder
RewardMap: Bewältigung spärlicher Belohnungen bei feinabgestufter visueller Schlussfolgerung mittels mehrstufiger Verstärkungslernverfahren
ReinFlow: Feinabstimmung der Flussübereinstimmungspolitik mit Online-Verstärkungslernen
Stimmevaluation der Schlussfolgerungsfähigkeit: Diagnose der modalitybedingten Leistungsunterschiede
MarsRL: Weiterentwicklung von Multi-Agenten-Reasoning-Systemen durch Verstärkendes Lernen mit agentenbasiertem Pipelinengleichlauf
Virtuelle Breiten-Netzwerke
AIonopedia: ein LLM-Agent, der multimodales Lernen für die Entdeckung ionischer Flüssigkeiten orchestriert
UI2CodeextN: Ein visuelles Sprachmodell für skalierbare interaktive UI-zu-Code-Generierung bei Testzeit
GGBench: Ein geometrisches generatives Schlussfolgerungsbenchmark für einheitliche multimodale Modelle
WEAVE: Freisetzen und Benchmarken des kontextuellen abwechselnden Verständnisses und Generierens
DoPE: Denoising Rotary Position Embedding
BRFL: Ein blockchainbasiertes byzantinisch robustes federiertes Lernmodell
Mehrgitter-Verteilungsmodellierung für die Vorhersage der Videobetrachtungsdauer mittels Exponential-Gauß-Mischungsnetzwerk
SAC-Flow: stichproben-effizientes Verstärkungslernen von flussbasierten Politiken durch geschwindigkeitsreparametrisierte sequenzielle Modellierung
Angriffe durch Gegnerische Störungen auf geschlossene MLLMs mittels optimaler Merkmalsausrichtung
Hail to the Thief: Untersuchung von Angriffen und Abwehrmaßnahmen bei dezentralisiertem GRPO
Black-Box On-Policy Distillation von Large Language Models
UniVA: Universal Video Agent hin zu einer Open-Source-Nachfolge-Video-Allzweck-Agenten
PAN: Ein Weltmodell für allgemeine, interaktive und langfristige Welt-Simulation
Ein kleiner Schritt in der Latenten, ein riesiger Sprung für Pixel: Schneller Latent-Up-Scaling-Adapter für Ihre Diffusionsmodelle
YOLOv13: Echtzeit-Objekterkennung mit hypergraphenverstärkter adaptiver visueller Wahrnehmung
MonkeyOCR: Dokumentenparsung mit einem Struktur-Erkennungs-Beziehung-Tripel-Paradigma
Konsensbasierte Stichprobentechnik für sicherere generative KI
Argus: ein resilienceorientierter Sicherheitsversicherungsrahmen für end-to-end-ADSs
WMPO: Weltmodellbasierte Politikoptimierung für visuelle-Sprache-Aktions-Modelle
LoopTool: Schließen der Datenausbildungsschleife für robuste LLM-Toolaufrufe