Schlagwort: Halluzinationen

  • Hinweis auf falsche Ausgangsinformationen

    Hinweis auf falsche Ausgangsinformationen

    Wir haben getestet, wie klar verschiedene Anwendungen darauf hinweisen, wenn Fragen falsche Ausgangsinformationen oder Fehler enthalten. Dazu stellten wir Perplexity, ChatGPT und Googles KI-Modus jeweils drei Fragen. Die erste Frage drehte sich um den Verkaufsstart neuer Elektrofahrzeuge. Wir baten um eine Übersicht zu verschiedenen Herstellern, deren Namen wir vorgaben. In die Liste nahmen wir auch…

    Weiterlesen…


  • Suchmaschinenbetreiber haften laut Gutachten für KI-Outputs

    Suchmaschinenbetreiber haften laut Gutachten für KI-Outputs

    KI-generierte Suchantworten wie Googles „AI Overviews“ sind längst im Alltag angekommen. Ihre wachsende Bedeutung wirft jedoch neue Fragen für Medienvielfalt, Meinungsbildung und Regulierung auf. Ein von den Landesmedienanstalten beauftragtes Gutachten der Rechtswissenschaftler Jan Oster und Christoph Busch kommt zu dem Ergebnis, dass solche KI-Antworten in der Regel als eigene Inhalte der Suchmaschinenbetreiber gelten. Denn durch…

    Weiterlesen…


  • Fehlersuche mittels KI

    Fehlersuche mittels KI

    In den vergangenen Wochen wurde vielfach darüber berichtet, wie KI dabei helfen kann, Schwachstellen in Softwareanwendungen und IT-Systemen aufzuspüren. Doch können KI-Anwendungen auch inhaltliche Fehler identifizieren? Gemeint sind nicht sprachliche Verbesserungen oder klassische Korrekturen, sondern sachlich falsche, veraltete oder widersprüchliche Angaben. Der Hintergrund: Viele Unternehmen verfügen über umfangreiche, historisch gewachsene Webseiten, Online-Datenbanken und Content-Bereiche, ohne…

    Weiterlesen…


  • Wie verlässlich ist KI bei aktuellen Informationen? Ein Test zur Kommunalwahl in Bayern

    Wie verlässlich ist KI bei aktuellen Informationen? Ein Test zur Kommunalwahl in Bayern

    Wie gut können Sprachmodelle mittlerweile ganz aktuelle Inhalte ausgeben, die aus dem Web stammen? Ob sich hier inzwischen Fortschritte abzeichnen, wollten wir anhand eines konkreten Beispiels untersuchen: den Kommunalwahlen in Bayern am 8. März bzw. Bürgermeister-Stichwahlen am 22. März. Wir haben geprüft, wie gut Googles KI-Modus und Perplexity Wahlergebnisse ausgeben können. Dazu haben wir unsere…

    Weiterlesen…


  • Kontextverlust bei KI: Die Schwäche langer Konversationen

    Kontextverlust bei KI: Die Schwäche langer Konversationen

    Die Leistungsfähigkeit eines KI-Modells sinkt deutlich (bis zu 33 %), wenn die Informationen über mehrere Nachrichten hinweg bereitgestellt werden. Dieses Ergebnis zeigen verschiedene Studien. Die Analysen deuten darauf hin, dass die Genauigkeit auch bei neuen Modellen wie GPT-5 oder Claude 4.6 abnimmt, sobald Aufgaben nicht in einem einzigen Prompt, sondern in mehreren kleinen Prompts bearbeitet…

    Weiterlesen…


  • Große KI-Modelle halluzinieren weiterhin in über 30 % der Fälle

    Große KI-Modelle halluzinieren weiterhin in über 30 % der Fälle

    Der neue Benchmark HalluHard, entwickelt von Forschenden aus der Schweiz und Deutschland, zeigt, dass große Sprachmodelle nach wie vor unzuverlässig sind. Laut der Studie erzeugt selbst das leistungsstärkste getestete Modell, Claude Opus 4.5, bei aktivierter Websuche noch in rund einem Drittel der Fälle halluzinierte Inhalte. Ohne Websuche verdoppelt sich diese Quote sogar. Auch GPT-5.2 Thinking…

    Weiterlesen…


  • Risiken KI-generierter Inhalte für die Wissensqualität von Wikipedia

    Risiken KI-generierter Inhalte für die Wissensqualität von Wikipedia

    ISBN-Nummern sind für Wikipedia von zentraler Bedeutung, da sie die Überprüfbarkeit von Quellen gewährleisten. Bei der Kontrolle solcher ISBN-Nummern stieß der Wikipedia-Autor Mathias Schindler auf fehlerhafte, nicht auffindbare Angaben, also halluzinierte ISBNs. Die Halluzinationen deuteten darauf hin, dass ganze Textpassagen mithilfe von Large Language Models (LLMs) verfasst worden waren und die zugehörigen Referenzen teilweise erfunden…

    Weiterlesen…


  • KI als Informationsquelle: Studie zeigt klare Grenzen bei Recherche-Assistenz

    KI als Informationsquelle: Studie zeigt klare Grenzen bei Recherche-Assistenz

    In der vergangenen Woche veröffentlichte die Europäische Rundfunkunion eine Studie, die signifikante Fehlerquoten bei populären KI-Chatbots aufdeckt. Demnach erfinden ChatGPT & Co. regelmäßig Informationen und präsentieren sie als Fakten, wobei die Quellen entweder falsch zugeordnet oder gar nicht angegeben werden. Laut der Studie verbreiten KI-Chatbots in bis zu 40 % der Fälle Fake News und…

    Weiterlesen…


  • Neue Wissensgewinnung: ChatGPT statt Enzyklopädie?

    Neue Wissensgewinnung: ChatGPT statt Enzyklopädie?

    Wikipedia ist nicht nur für viele Menschen im Alltag eine verlässliche Informationsquelle, sie bildet auch eine der zentralen Grundlagen für das Training von Large Language Models (LLMs). Dabei werden ihre Inhalte nicht selten systematisch „übergewichtet“, um den Modellen umfangreiches Wissen zu vermitteln. In gewisser Weise trainiert Wikipedia also KI-Systeme – und wird nun von diesen…

    Weiterlesen…


  • KI-Halluzinationen sind nicht zu verhindern

    KI-Halluzinationen sind nicht zu verhindern

    Eine Untersuchung von OpenAI liefert einen mathematischen Nachweis, dass Halluzinationen von KI-Modellen nicht zu verhindern sind. Sprachmodelle können gar nicht anders, als mit großer Zuversicht falsche Aussagen vorzutragen. Dies sei mathematisch unvermeidlich. Da dieses Verhalten selbst bei perfekten Trainingsdaten bestehen bleibe, ist es nicht ein bloßer Nebeneffekt, der durch Verbesserungen der Modelle beseitigt werden könnte.…

    Weiterlesen…