Eine vergiftete Seite reicht: KI-Modelle empfehlen zu 27 % Fake-Produkte
FORGE zeigt: Eine manipulierte Webseite reicht, damit KI-Suchmodelle in bis zu 27 % der Fälle nicht existierende Produkte empfehlen.
3 geprüfte Beiträge zu Benchmarks, Produkten und Branchenentwicklungen.
FORGE zeigt: Eine manipulierte Webseite reicht, damit KI-Suchmodelle in bis zu 27 % der Fälle nicht existierende Produkte empfehlen.
GeneBench-Pro testet mit unsauberen biologischen Datensätzen, ob Modelle Forschungsentscheidungen treffen können.
Google DeepMind hat Ende Februar Gemini 3.1 Pro veröffentlicht. Das Modell erreicht in 12 von 18 wichtigen Benchmarks den ersten Platz, insbesondere mit 77,1 % im ARC-AGI-2. Die Denkfähigkeit wurde im Vergleich zu Gemini 3 Pro um mehr als das Doppelte gesteigert, und eine neue MEDIUM-Stufe für den Denkmodus ermöglicht die Steuerung der Denktiefe.