Command Palette
Search for a command to run...
TreeOfLife-200M-Datensatz Zum Biologischen Sehen
Datum
Größe
Paper-URL
TreeOfLife-200M ist ein umfangreicher Datensatz zum biologischen Sehen, der 2025 von der Ohio State University veröffentlicht wurde. Die zugehörigen Ergebnisse sind:BioCLIP 2: Emergente Eigenschaften durch Skalierung hierarchischen kontrastiven Lernens", entwickelt, um biologisch basierte Modelle zu trainieren. Dieser Datensatz ist derzeit der größte und vielfältigste öffentliche, maschinenlernfähige Datensatz für biologische Computer-Vision-Modelle.
Der Datensatz enthält fast 214 Millionen Bilder aus 952.000 Artenkategorien und integriert Bilder und Metadaten von vier zentralen Anbietern von Biodiversitätsdaten: der Global Biodiversity Information Facility (GBIF), der Encyclopedia of Life (EOL), BIOSCAN-5M und FathomNet. Der Datensatz erweitert zudem die Vielfalt der Bildkontexte, indem er Museumsexemplare, Kamerafallen und Bilder aus der Citizen Science vollständig abdeckt.
Dataset-Beispiel
Zitat
@dataset{treeoflife_200m,
title = {{T}ree{O}f{L}ife-200{M} (Revision 94bbc0b)},
author = {Jianyang Gu and Samuel Stevens and Elizabeth G Campolongo and Matthew J Thompson and Net Zhang and Jiaman Wu and Andrei Kopanev and Zheda Mai and Alexander E. White and James Balhoff and Wasila M Dahdul and Daniel Rubenstein and Hilmar Lapp and Tanya Berger-Wolf and Wei-Lun Chao and Yu Su},
year = {2026},
url = {https://huggingface.co/datasets/imageomics/TreeOfLife-200M},
doi = {10.57967/hf/8980},
publisher = {Hugging Face}
}
KI mit KI entwickeln
Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.