Command Palette
Search for a command to run...
Papers
Täglich aktualisierte hochmoderne KI-Forschungsarbeiten, um Sie über die neuesten KI-Trends auf dem Laufenden zu halten

Eine Frage des TASTE: Verbesserung der Abdeckung und Schwierigkeit von Agent Benchmarks

Über die Skalierung von PEFT: Hin zu Millionen persönlicher Modelle mit Billionen Parametern































Eine Frage des TASTE: Verbesserung der Abdeckung und Schwierigkeit von Agent Benchmarks

Über die Skalierung von PEFT: Hin zu Millionen persönlicher Modelle mit Billionen Parametern






























Crafter: Ein Multi-Agent-Rahmenwerk zur Generierung bearbeitbarer wissenschaftlicher Abbildungen aus vielfältigen Eingaben
TACK: Eine statistische Evaluierung der Degradationsaktivität auf einem neuartigen TArgeting Chimeras Knowledge-Datensatz
Narrativer Webstuhl: Auf dem Weg zu einer kontrollierbaren langfristigen visuellen Konsistenz mit multimodaler Konditionierung
Das Aktualisieren von Harness ist nicht der Nutzen von Harness: Entkopplung der Evolutionsfähigkeiten in selbstentwickelnden LLM-Agenten
LongTraceRL: Lernen von Langkontext-Reasoning aus Such-Agent-Trajektorien mit Rubrik-Belohnungen
Vertrauensbereichs-Verhaltensmischung für On-Policy-Distillation
SwanVoice: Ausdrucksstarke Langform-Zero-Shot-Sprachsynthese für sowohl Monolog als auch Dialog
Repräsentationszwang für Bottleneck-freie einheitliche multimodale Modelle
GrepSeek: Training von Such Agents für direkte Korpusinteraktion
COLLEAGUE.SKILL: Automatisierte Generierung von KI-Fähigkeiten mittels Experten-Wissensdistillation
Agentic Systems als Verstärkung schwacher Modellierungsmodelle
YoCausal: Wie weit ist Videogenerierung vom Weltmodell entfernt? Eine Kausalitätsperspektive
minWM: Ein Full-Stack-Open-Source-Framework für Echtzeit-interaktive Video-Weltmodelle
CollectionLoRA: Sammeln von 50 Effekten in 1 LoRA mittels Multi-Lehrer On-Policy Distillation
OmniRetrieval: Vereinheitlichter Abruf über heterogene Wissensquellen hinweg
Qwen-VLA: Vereinheitlichung der Vision-, Sprach- und Aktionsmodellierung über Aufgaben, Umgebungen und Roboter-Embodiments hinweg
AgentDoG 1.5: Ein leichtgewichtiges und skalierbares Alignment-Framework für AI Agent-Sicherheit und -schutz
Weltaktionsmodelle: Die nächste Grenze in der verkörperten KI
Welt-Aktionsmodelle sind Zero-shot-Policies
ResearchMath-14K: Skalierung von Mathematik auf Forschungsniveau durch Agents
Selbstverbessernde Sprachmodelle mit bidirektionaler evolutionärer Suche
Von Pixeln zu Wörtern -- Hin zu nativen One-Vision-Modellen im großen Maßstab
Agent-Explorative-Policy-Optimierung für multimodales agentic Reasoning
ProRL: Effektives Reinforcement Learning für proaktive Empfehlung mittels rektifizierter Policy-Gradient-Schätzung
Gamma-World: Generative Multi-Agent Weltmodellierung Jenseits von Zwei Spielern
AutoFigure: Generierung und Verfeinerung publikationsreifer wissenschaftlicher Illustrationen
AutoResearch KI: Auf dem Weg zu einer KI-gestützten Automatisierung der Forschung für wissenschaftliche Entdeckungen
Engineering von Agent-Harnessing: Eine Übersicht
D^2-Monitor: Dynamische Sicherheitsüberwachung für Diffusions-LLMs mittels zögerungsbewusstem Routing
Geometriebewusste Repräsentationsrauschunterdrückung für robuste Mehransichten-3D-Rekonstruktion
Crafter: Ein Multi-Agent-Rahmenwerk zur Generierung bearbeitbarer wissenschaftlicher Abbildungen aus vielfältigen Eingaben
TACK: Eine statistische Evaluierung der Degradationsaktivität auf einem neuartigen TArgeting Chimeras Knowledge-Datensatz
Narrativer Webstuhl: Auf dem Weg zu einer kontrollierbaren langfristigen visuellen Konsistenz mit multimodaler Konditionierung
Das Aktualisieren von Harness ist nicht der Nutzen von Harness: Entkopplung der Evolutionsfähigkeiten in selbstentwickelnden LLM-Agenten
LongTraceRL: Lernen von Langkontext-Reasoning aus Such-Agent-Trajektorien mit Rubrik-Belohnungen
Vertrauensbereichs-Verhaltensmischung für On-Policy-Distillation
SwanVoice: Ausdrucksstarke Langform-Zero-Shot-Sprachsynthese für sowohl Monolog als auch Dialog
Repräsentationszwang für Bottleneck-freie einheitliche multimodale Modelle
GrepSeek: Training von Such Agents für direkte Korpusinteraktion
COLLEAGUE.SKILL: Automatisierte Generierung von KI-Fähigkeiten mittels Experten-Wissensdistillation
Agentic Systems als Verstärkung schwacher Modellierungsmodelle
YoCausal: Wie weit ist Videogenerierung vom Weltmodell entfernt? Eine Kausalitätsperspektive
minWM: Ein Full-Stack-Open-Source-Framework für Echtzeit-interaktive Video-Weltmodelle
CollectionLoRA: Sammeln von 50 Effekten in 1 LoRA mittels Multi-Lehrer On-Policy Distillation
OmniRetrieval: Vereinheitlichter Abruf über heterogene Wissensquellen hinweg
Qwen-VLA: Vereinheitlichung der Vision-, Sprach- und Aktionsmodellierung über Aufgaben, Umgebungen und Roboter-Embodiments hinweg
AgentDoG 1.5: Ein leichtgewichtiges und skalierbares Alignment-Framework für AI Agent-Sicherheit und -schutz
Weltaktionsmodelle: Die nächste Grenze in der verkörperten KI
Welt-Aktionsmodelle sind Zero-shot-Policies
ResearchMath-14K: Skalierung von Mathematik auf Forschungsniveau durch Agents
Selbstverbessernde Sprachmodelle mit bidirektionaler evolutionärer Suche
Von Pixeln zu Wörtern -- Hin zu nativen One-Vision-Modellen im großen Maßstab
Agent-Explorative-Policy-Optimierung für multimodales agentic Reasoning
ProRL: Effektives Reinforcement Learning für proaktive Empfehlung mittels rektifizierter Policy-Gradient-Schätzung
Gamma-World: Generative Multi-Agent Weltmodellierung Jenseits von Zwei Spielern
AutoFigure: Generierung und Verfeinerung publikationsreifer wissenschaftlicher Illustrationen
AutoResearch KI: Auf dem Weg zu einer KI-gestützten Automatisierung der Forschung für wissenschaftliche Entdeckungen
Engineering von Agent-Harnessing: Eine Übersicht
D^2-Monitor: Dynamische Sicherheitsüberwachung für Diffusions-LLMs mittels zögerungsbewusstem Routing
Geometriebewusste Repräsentationsrauschunterdrückung für robuste Mehransichten-3D-Rekonstruktion