Neue Apple-Studien befassen sich mit räumlich-funktionaler Intelligenz von KI-Modellen, automatischer Gebärdensprachannotation und 3D-Kopfmodellierung aus Fotos.
- Laut Apple Machine Learning Blog wurden drei neue Studien veröffentlicht
- SFI-Bench testet räumlich-funktionales Verständnis von Multimodal-LLMs
- Beste LLM-Ergebnisse bei SFI-Bench: Gemini 3.1 Pro, GPT-5.4-High, Gemini-3.1-Flash-Lite
- Studie zur Gebärdensprachannotation nutzt KI zur automatischen Beschriftung von Videos
- HeadsUp-Methode erstellt 3D-Kopfmodelle aus Multi-View-Aufnahmen mit 10.000 Probanden
- Anwendungen möglich für Siri mit räumlichem Kontext und Vision Pro Persona-Verbesserungen
Quelle: AppleInsider
Hinweis: Dieser Artikel wurde mithilfe von KI erstellt.

