Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten

Wenn das Reasoning seinen Gesetzen begegnet

Untersuchung der wissenschaftlichen Allgemeint intelligence von LLMs mittels wissenschaftlerausgerichteter Workflows































Wenn das Reasoning seinen Gesetzen begegnet

Untersuchung der wissenschaftlichen Allgemeint intelligence von LLMs mittels wissenschaftlerausgerichteter Workflows






























K2-V2: Ein 360-Offenes, reasoning-optimiertes LLM
VenusBench-GD: Ein umfassender Multi-Plattform-GUI-Benchmark für vielfältige Grundlagenaufgaben
MCIF: Multimodales, mehrsprachiges Benchmark für Anweisungsfolge aus wissenschaftlichen Vorträgen
NitroGen: Ein offenes Grundmodell für allgemeine Spielen-Agents
H-Neuronen: Über das Vorhandensein, die Wirkung und den Ursprung von Halluzinationsassoziierten Neuronen in LLMs
Die Welt ist Ihre Leinwand: Malen von anpassbaren Ereignissen mit Referenzbildern, Trajektorien und Text
Alchemist: Effizienzsteigerung beim Training von Text-zu-Bild-Modellen durch Meta-Gradienten-basierte Datenauswahl
Tiefe beliebige Panoramen: Ein Grundmodell für die Panoramatiefe-Schätzung
Generatives Refokussieren: Flexible Unschärfekontrolle aus einem einzigen Bild
StereoPilot: Lernen einer einheitlichen und effizienten Stereo-Umwandlung mittels generativer Prioris
Nächste-Embedding-Vorhersage macht starke Vision-Lerner
Agenten-KI: Eine Untersuchung der Horizonte multimodaler Interaktion
Künstlicher Intellekt als mathematischer Partner zur Förderung mathematischer Entdeckungen – Eine Fallstudie zur Homogenisierungstheorie
GenEval 2: Behandlung von Benchmark-Drift bei der Text-zu-Bild-Evaluation
PrivateXR: Der Schutz vor Datenschutzangriffen im Extended Reality durch erklärbare KI-gesteuerte differenzielle Privatsphäre
Temporale Reibungen und gerichtliche Ergebnisse: Analyse des Einflusses von Zeitverzögerungen auf die Strafzumessung in Cook County (2020–2024)
Meta-RL fördert die Exploration bei Sprach-Agenten
LLMCache: schichtweite Caching-Strategien zur beschleunigten Wiederverwendung bei der Transformer-Inferenz
OPENTOUCH: Vollflächige Berührung für die reale Interaktion bringen
VideoRewardBench: Umfassende Bewertung multimodaler Belohnungsmodelle für das Videoverstehen
Soul: Leben in digitale Menschen für hochauflösende, langfristige multimodale Animation einhauchen
IF-Bench: Benchmarking und Verbesserung von MLLMs für Infrarotbilder mit generativer Visualisierung
RecGPT-V2 Technischer Bericht
Vector Prism: Animieren von Vektorgrafiken durch Schichten der semantischen Struktur
OpenDataArena: Ein faire und offener Wettbewerbsspielplatz zur Bewertung des Wertes von Post-Training-Datensätzen
Video Reality Test: Können KI-generierte ASMR-Videos VLMs und Menschen täuschen?
WorldPlay: Hin zum langfristigen geometrischen Konsistenz für Echtzeit-Interaktives Weltmodellieren
MMGR: Multimodale generative Reasoning
Frontier Science: Beurteilung der Fähigkeit von KI, wissenschaftliche Aufgaben auf Expertenebene zu erfüllen
Der FACTS Leaderboard: Ein umfassender Benchmark für die Faktengenauigkeit von Large Language Models
K2-V2: Ein 360-Offenes, reasoning-optimiertes LLM
VenusBench-GD: Ein umfassender Multi-Plattform-GUI-Benchmark für vielfältige Grundlagenaufgaben
MCIF: Multimodales, mehrsprachiges Benchmark für Anweisungsfolge aus wissenschaftlichen Vorträgen
NitroGen: Ein offenes Grundmodell für allgemeine Spielen-Agents
H-Neuronen: Über das Vorhandensein, die Wirkung und den Ursprung von Halluzinationsassoziierten Neuronen in LLMs
Die Welt ist Ihre Leinwand: Malen von anpassbaren Ereignissen mit Referenzbildern, Trajektorien und Text
Alchemist: Effizienzsteigerung beim Training von Text-zu-Bild-Modellen durch Meta-Gradienten-basierte Datenauswahl
Tiefe beliebige Panoramen: Ein Grundmodell für die Panoramatiefe-Schätzung
Generatives Refokussieren: Flexible Unschärfekontrolle aus einem einzigen Bild
StereoPilot: Lernen einer einheitlichen und effizienten Stereo-Umwandlung mittels generativer Prioris
Nächste-Embedding-Vorhersage macht starke Vision-Lerner
Agenten-KI: Eine Untersuchung der Horizonte multimodaler Interaktion
Künstlicher Intellekt als mathematischer Partner zur Förderung mathematischer Entdeckungen – Eine Fallstudie zur Homogenisierungstheorie
GenEval 2: Behandlung von Benchmark-Drift bei der Text-zu-Bild-Evaluation
PrivateXR: Der Schutz vor Datenschutzangriffen im Extended Reality durch erklärbare KI-gesteuerte differenzielle Privatsphäre
Temporale Reibungen und gerichtliche Ergebnisse: Analyse des Einflusses von Zeitverzögerungen auf die Strafzumessung in Cook County (2020–2024)
Meta-RL fördert die Exploration bei Sprach-Agenten
LLMCache: schichtweite Caching-Strategien zur beschleunigten Wiederverwendung bei der Transformer-Inferenz
OPENTOUCH: Vollflächige Berührung für die reale Interaktion bringen
VideoRewardBench: Umfassende Bewertung multimodaler Belohnungsmodelle für das Videoverstehen
Soul: Leben in digitale Menschen für hochauflösende, langfristige multimodale Animation einhauchen
IF-Bench: Benchmarking und Verbesserung von MLLMs für Infrarotbilder mit generativer Visualisierung
RecGPT-V2 Technischer Bericht
Vector Prism: Animieren von Vektorgrafiken durch Schichten der semantischen Struktur
OpenDataArena: Ein faire und offener Wettbewerbsspielplatz zur Bewertung des Wertes von Post-Training-Datensätzen
Video Reality Test: Können KI-generierte ASMR-Videos VLMs und Menschen täuschen?
WorldPlay: Hin zum langfristigen geometrischen Konsistenz für Echtzeit-Interaktives Weltmodellieren
MMGR: Multimodale generative Reasoning
Frontier Science: Beurteilung der Fähigkeit von KI, wissenschaftliche Aufgaben auf Expertenebene zu erfüllen
Der FACTS Leaderboard: Ein umfassender Benchmark für die Faktengenauigkeit von Large Language Models