Multimodale Vision-Sprachmodelle (VLMs) könnten Naturforschern helfen, relevante Bilder in riesigen Datensätzen schneller zu finden. Doch wie gut meistern sie komplexe, wissenschaftlich präzise Suchanfragen? Ein neuer Test untersucht dies.Auch interessant: Was ist von künstlicher Intelligenz im Jahr 2025 zu erwarten? Große wissenschaftliche Fortschritte sind auf dem Weg