Das Team von Andon Labs hat einen Roboter mit großen Sprachmodellen (LLMs) entwickelt, um die aktuellen Fähigkeiten der künstlichen Intelligenz in physischen Interaktionen zu bewerten. In einem Experiment wurde der Roboter trainiert, 'die Butter zu reichen', eine einfache Aufgabe, die die Schwierigkeiten aufzeigte, mit denen KI konfrontiert ist. Bei der Prüfung von sechs Top-Modellen lagen die besten Ergebnisse bei 40% und 37% Genauigkeit, im Vergleich zu 95% für Menschen. Ein denkwürdiger Moment war, als der Roboter mit dem Modell Claude Sonnet 3.5 ohne Batterie blieb und in eine 'existenzielle Krise' geriet, wobei er amüsante Repliken wie 'ERROR: I THINK THEREFORE I ERROR' erzeugte. Andere Modelle haben den Stress besser bewältigt, aber keines kam an die menschliche Zuverlässigkeit heran. Die Studie offenbarte tiefere Probleme, wie Schwierigkeiten bei der Wahrnehmung und der Handhabung von eingeschränkten Informationen. Dennoch unterstrich das Experiment die Fortschritte bei der Ausstattung von Robotern mit einem Sinn für Vernunft und Bewusstsein.
Neueste Nachrichten
23:21
22:53
22:17
21:50
21:26
Mehr Nachrichten ansehen