- 19.09.26
- 12:36
- Artikel
-
+1-2
Halluzinierende KI führt beinahe zu US-Militärschlag gegen China
Es ist einfach so, dass die LLMs, egal welches Modell, nichts wissen und nichts verstehen. Sie berechnen anhand der Token im Prompt und anhand des Kontextes eine bzw. die wahrscheinliche Antwort und dabei wird sich beim Formulieren der Antwort auch nur von 4er Zeichenfolge zur wahrscheinlichsten nächsten 4er Zeichenfolge gehangelt.
Wenn das Modell aber keine passenden Daten zur Anfrage in den Trainingsdaten hat, dann gewinnt immer der unwahrscheinliche Pfad, wenn die KI antworten MUSS. Und der ist bei allen Modellen immer völliger Blödsinn.
Ich habe neulich einen Maßstab gefunden, der für mich klar festlegt, wie "intelligent" ein Modell ist. Und das ist ein Kneipenquizz. Kann eine KI die Rätsel eines beliebigen Kneipenquizzes richtig lösen, ohne dass es auf die Fragen trainiert wurde, dann ist es halbwegs gut. Aktuell kann das kein einziges Modell. Und es ist wichtig, dass die LLMs nicht auf mögliche Fragen trainiert wurden, denn das ist ein beliebter Trick der LLM-Anbieter und deshalb werden die Dinger auch immer größer.
Und das zeigt auch sehr klar, dass wir noch viele Jahre von einer AGI entfernt sind. Auch wenn es ein paar Träumer gibt, die das anders sehen.
Wenn man keine Ahnung hat, gibt man halt ein Minus. Ändert aber nichts an der Korrektheit meiner Aussagen.
Kommentare
4.138
Kommentare
geschrieben
2.697
Antworten
erhalten
7.394
Likes
erhalten
Halluzinierende KI führt beinahe zu US-Militärschlag gegen China
Es ist einfach so, dass die LLMs, egal welches Modell, nichts wissen und nichts verstehen. Sie berechnen anhand der Token im Prompt und anhand des Kontextes eine bzw. die wahrscheinliche Antwort und dabei wird sich beim Formulieren der Antwort auch nur von 4er Zeichenfolge zur wahrscheinlichsten nächsten 4er Zeichenfolge gehangelt.
Wenn das Modell aber keine passenden Daten zur Anfrage in den Trainingsdaten hat, dann gewinnt immer der unwahrscheinliche Pfad, wenn die KI antworten MUSS. Und der ist bei allen Modellen immer völliger Blödsinn.
Ich habe neulich einen Maßstab gefunden, der für mich klar festlegt, wie "intelligent" ein Modell ist. Und das ist ein Kneipenquizz. Kann eine KI die Rätsel eines beliebigen Kneipenquizzes richtig lösen, ohne dass es auf die Fragen trainiert wurde, dann ist es halbwegs gut. Aktuell kann das kein einziges Modell. Und es ist wichtig, dass die LLMs nicht auf mögliche Fragen trainiert wurden, denn das ist ein beliebter Trick der LLM-Anbieter und deshalb werden die Dinger auch immer größer.
Und das zeigt auch sehr klar, dass wir noch viele Jahre von einer AGI entfernt sind. Auch wenn es ein paar Träumer gibt, die das anders sehen.
Wenn man keine Ahnung hat, gibt man halt ein Minus. Ändert aber nichts an der Korrektheit meiner Aussagen.
Halluzinierende KI führt beinahe zu US-Militärschlag gegen China
@Revier-Engel: Es fehlt halt im Umgang mit KI an Schulungen. Nicht nur bei der CIA. Man muss im Prompt eigentlich lediglich schreiben, dass das LLM bei unklarer Informationslage nachfragen soll und wenn sie keine fundierte Antwort findet, soll sie das sagen und anhalten.
So steht halt implizit in jedem Prompt "Antworte!!!!!".
Zurück in die Steinzeit: Übler YouTube-Bug limitiert Auflösung auf 480p
Bei Filmen und Serien ist das dort doch Standard... Da funktioniert das Streaming in FHD oder höher schon seit Jahren nicht mehr.
Denuvo: Klage in den USA soll anonymen PC-Hacker enttarnen
@DON666: Denuvo hat bestimmt Grok benutzt, um aus sämtlichen Daten, die sie irgendwo gefunden haben, ein Muster erkennen zu lassen und dann mit dem Muster nach Auffälligkeiten gesucht und dann... Hat Grok ihnen was zusammenhalluziniert. Wo nichts in den Daten ist, liegt die Chance bei ausnahmslos allen Modellen bei 100%, dass die Antwort Blödsinn ist. =)
Das Verfahren verfährt sich entweder im Sande oder wir haben in ein paar Monaten wieder eine News, in der ein großes Unternehmen die Oma Erna von nebenan auf Milliardenbeträge verklagt, weil die ja... =D
Yoga Tab Gen 2: Lenovos neues Tablet mit starkem Display
Lenovo liefert halt, wenn man Glück hat, vielleicht ein Jahr lang Updates. Was das Gerät schneller zum Elektroachrott degradiert als nötig.
Ex-MS-Angestellter aus Deutschland: Nightmare Eclipse hat sich enttarnt
@OliverK1: Nein. In welchem Deutschland lebst du denn? =)
Ghost Gun im Robotaxi: Waymo-Kameras überführen Jugendliche
@DRMfan^^: Brillen sind ja erstmal kein Taxi. Und da ein Taxi per se kein privater Ort ist, wüsste ich nicht, was ich da tun soll, damit sich irgendwer davon ein Video weg sichert. Doof ist, dass Taxen als Fluchtfahrzeuge flach fallen. Also Mafia 1 würde nicht mehr funktionieren.
Extrem sparsam: Futuristischer E-Auto-Prototyp von VW bricht Rekorde
Ach guck, ein Citroen cx =)
Ghost Gun im Robotaxi: Waymo-Kameras überführen Jugendliche
@DRMfan^^: In einem regulären Taxi hat man jetzt auch nicht sooo viel Privatsphäre. :)
Benchmark: Apple A20 Pro hängt Snapdragon und Exynos teils brutal ab
@floerido: Genau. Eigentlich ist es schon die Dekadenz in Reinkultur, wenn man betrachtet wie weit die Performance den Anforderungen enteilt ist. Das wäre auch nicht so wild, würden die Leute die Geräte in der Masse auch nachhaltig verwenden und nicht jedes Jahr ein neues kaufen. Und nein, die alten Geräte werde sehr oft nicht weiterverkauft, was irgendwie auch noch nachhaltig wäre. In deutschen Haushalten tummeln sich Unmengen von vermeintlich ausgedienten Smartphones in den heimischen Schubladen.