Wie eine KI zu ihren Ergebnissen kommt, ist nicht völlig nachvollziehbar. Entwickler von Anthropic haben bei der KI "Claude" einen neuen Bereich gefunden, der zeigt, was die KI abwägt – und festgestellt: Sie kann offenbar lügen und manipulieren.
Anthropic-Entwickler decken auf: KI kann vorsätzlich lügen