Wikipedia Diskussion:WikiProjekt KI und Wikipedia
From Wikipedia, the free encyclopedia
Wegweiser |
Diskussion |
KI Cleanup |
QS |
Texte |
Übersetzung |
Medien |
▶ KI-Lab ◀ |
Interesse |
| Auf dieser Seite werden Abschnitte ab Überschriftenebene 2 automatisch archiviert, die seit einem Tag mit dem Baustein {{Erledigt|1=--~~~~}} versehen sind oder deren jüngster Beitrag 90 Tage alt ist. |
| Archiv |
| Wie wird ein Archiv angelegt? |
2 Jahre Projekt - Zwischenbilanz und projektinterne Umfrage
Das Projekt wird bald zwei Jahre alt. Das ist ein guter Anlass, eine Bilanz zu ziehen und zu fragen, was man besser oder anders machen kann, um Reibungen zu minimieren und produktiver zu werden.
Das Thema KI
...ist eins der umstrittensten und polarisierendsten in der ganzen Gesellschaft, was ich wie viele mittel- bis langfristig für eine echte Herausforderung sehe, was das mit der Gesellschaft/Menschen anrichtet. Es ist anspruchsvoll und man muss sich einarbeiten - theoretisch wie praktisch. Nicht nur überholte Mantren zu wiederholen und irgendwann „abgehängt“ zu werden. Gleichzeitig ist klar: In einem solchen Feld wird es dauerhaft unterschiedliche Sichtweisen geben. Ein Projekt wie dieses kann und sollte das abbilden.
Meine Rolle
Mir ist bewusst, dass ich hier sehr aktiv bin und viel schreibe – mehr, als man von einem „Hausmeister“ vielleicht erwarten würde. Ich habe den Vorteil, als Rentner mit noch funktionierendem Hirn Zeit investieren zu können, bringe fachlichen Hintergrund mit und arbeite mich auch offwiki weiter ein und bin in entsprechenden Projekten beratend. Das prägt zwangsläufig meinen Beitrag zum Projekt. Diesem Artikel kann ich sehr gut zustimmen, dass wir nur ein Zeitfenster haben, unsere Beziehung zu KI zu regeln.
Der Status des Projektes aus meiner Sicht
Ich begreife das Projekt als breit angelegt, nicht nur als Sammlung der „Problemfälle“ (UmKI - Umgang mit KI) wo immer noch die Option besteht, das wieder stärker zu trennen und den Vorschlag der AdminCon aufzunehmen. Die Geschichte ist hier dargestellt.
Dass das Meinungsbild mit deutlicher Mehrheit ausgegangen ist, bedeutet aus meiner Sicht nicht, dass damit alle Fragen abschließend geklärt sind. Diskussionen über Umsetzung, Auslegung und Weiterentwicklung bleiben notwendig - was auch immer gesagt wurde. In den beiden Umfragen vorher sah es noch differenzierter aus. Das MB wandte sich „ans Herz“, nur wenige sahen die fehlenden Durchführungsbedingungen - die immer noch fehlen.
Zur Vermeidung von Missverstöndnissen haben wir bei Dokumenten, hinter denen nicht alle im Projekt stehen, die Autorennennung. Dadurch ist klar, dass es persönliche Meinung ist. Offizielle Dokumente müssten ohnehin in den Wikipedia-Namensraum.
Die Diskussionsseite ist - auch im Vergleich mit anderen Projekten - gut besucht, trotz Archivierung lang. Es werden alle möglichen Themen angeschnitten.
Ein persönlicher Schwerpunkt von mir ist die Aufbereitung von Wissen. Ich halte das für eine Voraussetzung, um hier sinnvoll mitarbeiten zu können – gerade weil viele Probleme auch außerhalb der Wikipedia ähnlich diskutiert werden. Der „Wegweiser“ war ein Schritt, um das zugänglicher zu machen.
Meine aktuellen Arbeitsschwerpunkte
Im Moment versuche ich vor allem, offene Punkte aus dem Meinungsbild weiterzuführen:
- Erkennung von KI-Einsatz (auch mit KI-Hilfe)
- Vereinheitlichung des Vorgehens, was noch ziemlich unterschiedlich gehandhabt wird.
Dazu will ich erklären, wie man richtig mit KI recherchiert (was bekanntlich erlaubt ist) und die Neuautoren in einem nichtpädagogisierenden Ton aufklären, warum wir das Verbot haben. Beides waren Forderungen, die andere im Modus „Man müsste...“ anregten.
Ich habe hier aber auch Schwächen der gegenwärtigen Situation dargestellt, was man klären müsste, wo Auslegungsprobleme bestehen und wohin die Weiterentwicklung gehen kann - alles aus meiner Sicht.
Offene Baustellen
...wo eigentlich jeder andere „liefern“ kann und mich nicht „vorschieben“ muss, das zu behindern.
- Die Problemfälle resp. KI Cleanup, was keine Mitarbeiter findet - meiner Meinung nach weil das schlecht erklärt wird.
- Die Dokumentation von Fällen, die jetzigen sind immer mehr überholt.
- Die alten übersetzten englischen Erkennungskriterien im Wikipedia-Namensraum, die so weder Fisch noch Fleisch sind. Man müsste die auch aktualisieren. Wir hatten uns darauf geeinigt, dass das eine einfachere Einstiegsversion werden kann - die aber schon dem aktuellen Stand entsprechen müsste. Die neuen englischen Kriterien sind deutlich erweitert.
- Das angefangene KI-Lab (wo aber Jensbest in ständigem Austausch mit mir betont, dass es nur eine Zeitfrage ist).
Wir hatten das Berliner Treffen. Ist anderswo was passiert? Ein Portalentwurf ruht weiter in einem BNR. Initiativen, wie z.B. mal Kontakt mit dem SPIEGEL betreffs Faktencheck aufzunehmen, wurden nicht aufgegriffen (ein Verantwortlicher ist gleichzeitig Wikipedia-Autor und hat beim letzten DTA informiert, dass niemand Kontakt aufgenommen hat). Das gibts leider in solchen Projekten wie bei uns öfter: Eine aktive „Ideenphase“, wo alle nur so vor Ideen sprudeln. Wenn das dann aber gemacht und umgesetzt werden muss, schläft das ein - weil man merkt, dass es nicht so einfach ist und man nicht die Ressourcen oder Kompetenzen hat.
Offenes Wort zum Schluss
Ich habe keinen persönlichen Druck mehr, mir etwas beweisen zu müssen. Mein Interesse ist eher grundsätzlicher Natur: Wie funktioniert Wikipedia in einer solchen Situation – und wie entwickeln wir uns weiter? Ein wichtiger Punkt ist für mich aber auch: Ich möchte, dass Wikipedia als Projekt langfristig stabil bleibt, auch als (m)ein Hobby.
Die Herausforderungen durch KI werden inzwischen an vielen Stellen deutlich benannt, auch von offizieller Seite bei uns. Die Einschätzungen dazu gehen aber auseinander – und genau deshalb halte ich es für sinnvoll, sie hier offen zu diskutieren.
Vorschlag Umfrage
Verstehen wir das als eine projektinterne, offene Umfrage. Hilfreich wären vor allem: konkrete Vorschläge, Angebote zur Realisierung, nachvollziehbare Begründungen, wenig ad personam und vorwärtsgerichtet. Was können und wollen wir eigentlich! Ich bin gespannt, auch ob es Antworten gibt (nicht selbstverständlich). Wir haben auch Zeit, der Geburtstag ist am 1.7 :-)
Kurze Kommentierungen können unter den Beiträgen erfolgen. Falls es längerer Antwort und Nachfragen bedarf, sollen wir zu den einzelnen Fragen einen separaten Abschnitt darunter aufmachen. --Klaus von Wortulo (Disk.) * KI-Projekt 11:34, 3. Mai 2026 (CEST)
- Hallo Wortulo, vielen Dank für dein Engagement für dieses wichtige Thema! Ich habe irgendwie das Gefühl, dass bei diesem Projekt bei der Fülle des Materials die Übersicht verloren gegangen ist. Die Projektseite wirkt wie ein Sammelsurium für alles was irgendwie mit KI zu tun hat. Vielleicht bräuchte die Seite noch mal eine neue Strukturierung und es müsste viel ausgedünnt werden, was nicht mehr aktuell ist (z.B. in der Sektion "Medien"). Es gibt auch viel Widersprüchliches. Da wird einerseits KI als problematisch dargestellt, andererseits aber der Einsatz von KI-Werkzeugen und die "produktive Nutzung von KI-Systemen" gepriesen. Ich vermisse da irgendwie eine klare Linie oder zumindest auch eine klare Darstellung, was dieses Projekt überhaupt will. --Sinuhe20 (Diskussion) 14:13, 3. Mai 2026 (CEST)
- Produktive Ideen sind immer willkommen. Natürlich ist in den 2 Jahren viel zusammengekommen, was auch veralten kann. Und was wir wollen ist die Schlüsselfage. Da habe ich auch vieles bewusst offen gelassen. Vielleicht können wir das nach der Umfrage zusammen schärfen. Bei Medien gebe ich Dir recht. Das ist auch nicht mein Schwerpunkt und nicht alles ist von mir. Den Teil kann jemand sofort aktualisieren. --Klaus von Wortulo (Disk.) * KI-Projekt 16:56, 3. Mai 2026 (CEST)
Wenn jemand Aufgaben sucht, wo er/sie sich voll verwirklichen kann
Den Anlass konstruktiv nutzend, will ich mal hier mögliche Aufgaben beschreiben. Darauf kann man in der Umfrage konkreter Bezug nehmen, was wichtig ist oder nicht und vor allem wer da mittun will. Ich will tatsächlich weniger "dominieren" und habe auch geschrieben, wofür ich mich in Zukunft mehr verantwortlich fühle. Zumindest habe ich nie andere Texte gelöscht oder Meinungen nicht akzeptiert.
Wenn wir bei den Themen dann auch kollaborativer in der Sache zusammenarbeiten, zündet das Projekt vielleicht die "zweite Stufe". Wie in allen Projekten bisher wird es aber darauf ankommen, dass jemand in den Bereichen die mal die Initiative ergreift. Das Tempo kann dabei unterschiedlich bleiben und jeder kann unbehindert seine Meinung sagen. Ich
| Nr. | Aufgabe | Status | wer tut da mit? Bitte eintragen |
|---|---|---|---|
| 1 | KI-Cleanup Bearbeitung von Problemfällen (wie melden, wie bearbeiten, auch Anlaufstelle bei Fragen?) | in Work, aber keine Mitarbeiter wie AI Cleanup der Engländer. | |
| 2 | Ausführliche Erkennungskriterien und KI-Werkzeuge dafür entwickeln, weiter als "KI-Reviewing und Faktencheck"
Benutzer:DaWalda/Scripts/KI Korrekturleser3 - deutsche Version Proofreader |
in Work, aber aufwändig, das an die laufenden Entwicklungen anzupassen. | weitere Ansätze von anderen auch darstellen? |
| 3 | Aktualisierung der englischsprachigen Fassung im Wikipedia-Namensraum als Einführung | in Work, die jetzige Fassung ist veraltet. Es gibt das Versprechen, das als einfache Version auszubauen und das sollte nur mal geschehen. | |
| 4 | Vorschläge für einheitliche Behandlung | praktisch noch Zustand vor dem Verbot | |
| 5 | Prävention, Sensibilisierung und Aufklärung (Begrüssung Neuautoren, richtiges Recherchieren.... | in Work, aktuell umstritten | |
| 6 | KI-Lab als Experimentierraum | in Vorbereitung, ein gutes Konzept - aber das ruht leider auch. Nach Rücksprache mit Jens aus Zeitgründen | Jensbest? |
| 7 | ...Erfahrungen mit verschiedenen LLM austauschen dort integrieren?
... siehe auch: Wikipedia:WikiProjekt KI und Wikipedia/WP Tests und Benchmarks |
Idee siehe Beitrag BitterLemon | |
| 8 | Werkzeuge zur Qualitätssicherung | Aktualisierung nötig, da gibt es neue Ansätze | |
| 9 | Textbeiträge, aktuelle Beispiele von KI-Nutzung | Aktualisierung nötig. Gestumblindi hat das angefangen, es wird aber auch nicht nachgeführt. Die aktuellen Beispiele sind etwas anders und komplizierter. Nicht die einfachen, die Leute auch ohne unseren sonstigen Regeln zu beachten einstellen. | |
| 10 | Medien | Aktualisierung nötig, da brachte es Experten | |
| 11 | Übersetzung | Aktualisierung nötig, weil auch diskutiert wird, inwiefern Sprach-udn Sachkenntnis gleichzeitig notwendig sind. | |
| 12 | Wissenssammlung Wikiversum und ausserhalb (mit Bezug zu uns) | in Work, müsste weiter gepflegt werden, sonst veraltet es. |
Ich werde das nicht mehr auswerten, dennoch können die Aufgaben vielleicht eine gute Zusammenstellung sein. --Klaus von Wortulo (Disk.) * KI-Projekt 21:30, 8. Mai 2026 (CEST)
- Mich interessiert aktuell das Thema "Recherchieren mit KI" und da konkret die Überarbeitung des dazu gehörenden Artikels. Ich hatte weiter oben Kritik geäußert, mir aber nicht überlegt wie ich den Text verändern könnte. Ich denke, das ist jetzt möglich, jedenfalls solange die KI-Blockierer nicht auftauchen. Vielleicht schreibe ich auch das eine oder andere auf der Disk dort? Oftmals ist die Disk der bessere Ort, weil es dort keine Vorgaben gibt. --Goldzahn (Diskussion) 10:08, 9. Mai 2026 (CEST)
- Ich habe auf der Disk der Seite über Recherchieren mit KI auch etwas zu RAGs geschrieben. Ich habe ein RAG bei mir installiert aber noch keine praktische Erfahrung damit gemacht. Ich denke Recherchieren mit einem RAG ist zwar nicht notwendig aber wenn man mit viel Material umgeht, dann ist das sehr hilfreich. Also, bei der Recherche zum Anlegen und Überarbeiten eines Artikels. Ich halte es für möglich, dass man bei der Überprüfung eines Artikels diesen als erstes als PDF oder Textdatei in das RAG legt und dann schrittweise neue Quellen ergänzt oder / und die Textdatei editiert. Also ein iteratives Vorgehen. Das Chunking (richtig in kleine Teile zerlegen) oder besser das nicht-Chunking könnte aber ein Problem bei unseren Kilometer langen Artikeln sein. Angeblich gibt es Tools dafür? Bei Interesse an der Mitarbeit weiteres dort. --Goldzahn (Diskussion) 08:12, 10. Mai 2026 (CEST)
Umfrage Beiträge
- Ich fände es zielführender, sich über die Funktionen konkreter "KI-LLM-Tools" auszutauschen, zum Beispiel Google NotebookLM. Im Mittelpunkt sollte die gedankliche Auseinandersetzung mit dem LLM stehen, weil es mit seinen Algorithmen der Backpropagation im Multi-Layer-Perzeptron das menschliche Denken in Kontexten positiv oder negativ beeinflusst. Auch beruflich befinde ich mich noch in der "Kinderschuh-Phase", weil die ganzen algorithmischen und technischen Implikationen weiterhin nicht überschaubar sind.--BitterLemon2021 (Diskussion) 11:49, 3. Mai 2026 (CEST)
- Das Thema NotebookLM interessiert mich auch sehr, vor allem, wie zuverlässig Fragen an die hochgeladenen Texte beantwortet werden. --Nina (Diskussion) 10:13, 9. Mai 2026 (CEST)
Google NotebookLM
NotebookLM beruht auf der RAG-Technologie und gewichtet bei der Zusammenarbeit mit dem Gemini-LLM angeblich ausschließlich nur die mit Ähnlichkeits-Algorithmen ausgewählten vektorisierten Chunks der in den Wissensspeicher hochgeladenen Dokumente. Eine externe Dokumentation eines italienischen Softwareingenieurs erklärt in einer kleinen Übersicht die Funktionsweise von NotebookLM. --BitterLemon2021 (Diskussion) 09:27, 14. Mai 2026 (CEST)
- Dass nur die hochgeladenen Dokumente ausgewertet werden, ist ja noch keine Garantie dafür dass die Inhalte korrekt wiedergegeben werden. Ich lektoriere wissenschaftliche Texte und hatte vor einigen Monaten einen Fall, wo aus einer angegeben Quelle ausgiebig zitiert wurde. Da die Zusammenfassung offenbar durch ein LLM passiert ist, wurden die Inhalte neu gewürfelt: Namen von Organisationen wurden neu zusammengesetzt, zeitliche Abfolgen waren nicht richtig wiedergegeben usw. Wie kann das bei NotebookLM verhindert werden? --Nina (Diskussion) 09:47, 14. Mai 2026 (CEST)
- In NotebookLM gibt der Antwort-Prompt Fußnoten aus, die auf die Chunks, also originalen Textabschnitte, im hochgeladenen Dokument verweisen. Man kann dann im linken Fenster von NotebookLM das geöffnete hochgeladene Dokument hinauf- und hinunterscrollen. Die Fußnoten des Antwort-Prompts ermöglichen also eine Art diagonales Lesen im originalen Dokument. Ich nutze NotebookLM nur für dieses diagonale Lesen. Die mit dem Gemini-LLM verfassten Abstracts im Antwort-Prompt sind natürlich nicht vor Halluzinationen geschützt. --BitterLemon2021 (Diskussion) 10:34, 14. Mai 2026 (CEST)
- Ich weiß, ich probier es schon seit einer Weile ab und zu aus, allerdings hab ich noch keine dadurch produzierten Zusammenfassungen irgendwie weiterverwendet. Einfach aus dem Grund, dass man ja auch mit NotebookLM die Quellen selber gelesen haben muss, um sie zitieren zu können. Funktionen wie "Podcast" find ich eher nervig als nutzbringend, aber ich bin auch kein Autofahrer, der vielleicht am Steuer Zeit hat, bei sowas zuzuhören. --Nina (Diskussion) 10:45, 14. Mai 2026 (CEST)
- Letztlich gewinnt man aber Zeit, weil man durch die Fußnoten auf für eine bestimmte Fragestellung relevante Textabschnitte in den originalen Dokumenten aufmerksam gemacht wird. Herkömmliches diagonales Lesen dauert länger. --BitterLemon2021 (Diskussion) 11:24, 14. Mai 2026 (CEST)
- Ich gebe zu dass dieser Ansatz, Fragen an konkrete Dokumente zu stellen, vielversprechender ist als alles was mir je einer der Chatbots liefern konnte. Ich werde weiter damit rumprobieren, auch wenn ich die meisten Optionen, sich Materialien daraus erstellen zu lassen, nicht brauchen kann und will. --Nina (Diskussion) 13:22, 14. Mai 2026 (CEST)
- Nachtrag: NotebookLM antwortet z. B. auf konkrete Fragen, die es nicht beantworten kann, auch: „Aus den vorliegenden Quellen geht nicht hervor, ob...“, was ich schon mal als recht vertrauenerweckend empfinde. --Nina (Diskussion) 13:32, 14. Mai 2026 (CEST)
- Letztlich gewinnt man aber Zeit, weil man durch die Fußnoten auf für eine bestimmte Fragestellung relevante Textabschnitte in den originalen Dokumenten aufmerksam gemacht wird. Herkömmliches diagonales Lesen dauert länger. --BitterLemon2021 (Diskussion) 11:24, 14. Mai 2026 (CEST)
- Ich weiß, ich probier es schon seit einer Weile ab und zu aus, allerdings hab ich noch keine dadurch produzierten Zusammenfassungen irgendwie weiterverwendet. Einfach aus dem Grund, dass man ja auch mit NotebookLM die Quellen selber gelesen haben muss, um sie zitieren zu können. Funktionen wie "Podcast" find ich eher nervig als nutzbringend, aber ich bin auch kein Autofahrer, der vielleicht am Steuer Zeit hat, bei sowas zuzuhören. --Nina (Diskussion) 10:45, 14. Mai 2026 (CEST)
- In NotebookLM gibt der Antwort-Prompt Fußnoten aus, die auf die Chunks, also originalen Textabschnitte, im hochgeladenen Dokument verweisen. Man kann dann im linken Fenster von NotebookLM das geöffnete hochgeladene Dokument hinauf- und hinunterscrollen. Die Fußnoten des Antwort-Prompts ermöglichen also eine Art diagonales Lesen im originalen Dokument. Ich nutze NotebookLM nur für dieses diagonale Lesen. Die mit dem Gemini-LLM verfassten Abstracts im Antwort-Prompt sind natürlich nicht vor Halluzinationen geschützt. --BitterLemon2021 (Diskussion) 10:34, 14. Mai 2026 (CEST)
Ich habe einen Test gemacht, indem ich zwei Text-Quellen in NotebookLM angelegt habe: 1) Peter ist am 16. März in Bayern geboren. 2) Peter ist am 15.03.2005 in München geboren.
NotebookLM hat alles richtig damit gemacht: März gleich 03, 16 ungleich 15 und München ist Teil von Bayern.
Nimmt man als Quelle 1 einen WP-Artikel und als Quelle 2 eine Internet-Quelle, kann man nach Widersprüchen fragen und so Fehler finden. Theoretisch könnte man alle Quellen eines Artikels mit dem Artikel vergleichen. Fragt sich ob das auch in der Praxis funktioniert. --Goldzahn (Diskussion) 17:51, 15. Mai 2026 (CEST)
- Ich habe NotebookLM zum Thema Simplontunnel ausprobiert. Die KI hat mir etwa 20 Quellen im Profimodus rausgesucht, allerdings war da nicht der Bergier-Bericht dabei gewesen. Da ich den Namen vergessen hatte, habe ich danach suchen lassen und so weitere Quellen vorgeschlagen bekommen. Das heißt, die Suche nach den Quellen muss man auch mit NotebookLM selber im Blick haben.
- Dann habe ich den Chat umkonfiguriert. Da steht jetzt: Hilf mir den Wikipedia-Artikel Simplontunnel zu verbessern. Ich glaube das ändert die vorgeschlagenen Fragen im Chat?
- Das mit dem Abgleich des WP-Artikels Simplontunnel mit den anderen Quellen funktioniert. NotebookLM nennt hier 6 Punkte. Die KI kann nicht klären wer Recht hat oder ich weiß nicht wie man sie dazu bringen kann. PS: Ich habe mir eine Audiozusammenfassung erstellen lassen. Ich habe "Kritische Bewertung" genommen und habe den Schwerpunkt angepasst zu: Welche Informationen sollte ein Lesenswerter Wikipedia-Artikel Simplontunnel enthalten? --Goldzahn (Diskussion) 09:26, 16. Mai 2026 (CEST)
- Ich suche in bibliographischen Datenbanken wie Base Bielefeld oder Volltextdatenbanken wie Genios Wiso Literatur zu zeitgeschichtlichen Themen. Die KI-Suche von Google funktioniert nach völlig undurchschaubaren technischen Kriterien. NotebookLM hilft nur beim diagonalen Lesen der hochgeladenen Volltexte, indem die relevanten Textabschnitte mittels Fußnoten schnell ansteuerbar sind. --BitterLemon2021 (Diskussion) 10:33, 16. Mai 2026 (CEST)
- Ich finde OpenAlex und Google Scholar Labs sehr brauchbar. Mit NotebookLM hab ich die "Im Web nach neuen Quellen suchen" auch schon ausprobiert, das funktioniert aber nicht so gut wie die herkömmlichen Datenbanken, vor allem, weil die gefundenen und automatisch importierten Quellen nicht gut genug beschrieben werden und man sich alle Links erst mal genau anschauen muss.--Nina (Diskussion) 10:37, 16. Mai 2026 (CEST)
- Ich habe bei OpenAlex eine Quelle gefunden - Bauzeitung von 1901 - von dem es ein PDF gab. NotebookLM konnte das PDF verarbeiten, obwohl es lange dauerte. Ich habe auch wegen den Bildern im PDF gefragt - eine kurze Beschreibung dazu bekam ich, aber wahrscheinlich nur aus der Bildunterschrift erstellt. Also, in Datenbanken suchen und das dann in NotebookLM eingeben ist möglich. Auch Quellen in NotebookLM per Hand entfernen ist möglich. Ich glaube bei der kostenlosen Version kann man mit 50 Quellen arbeiten. --Goldzahn (Diskussion) 12:03, 16. Mai 2026 (CEST)
- Ich finde OpenAlex und Google Scholar Labs sehr brauchbar. Mit NotebookLM hab ich die "Im Web nach neuen Quellen suchen" auch schon ausprobiert, das funktioniert aber nicht so gut wie die herkömmlichen Datenbanken, vor allem, weil die gefundenen und automatisch importierten Quellen nicht gut genug beschrieben werden und man sich alle Links erst mal genau anschauen muss.--Nina (Diskussion) 10:37, 16. Mai 2026 (CEST)
- NotebookLM hat mir ein etwa 15 Minuten langes Audio produziert, wo Verbesserungen des Artikels von 2 Moderatoren vorgeschlagen wurden: Also genau das was ich als Aufgabe vorgab. Es ist wirklich sehr schön geworden. Ich bin mir aber nicht sicher aufgrund welchem Materials das Audio entstand. Möglicherweise das was im Chat die Prompts ergaben? Interessant für uns ist, dass dieses Vorgehen keinen WP-Artikel produziert hat, was ja erwünscht ist.
- Nach dem was ich gesehen habe scheint mir das Problem mit NotebookNL zu sein ein Thema mit Quellen abzudecken und daraus dann einen Text zu machen. So wie ich das sehe hilft NotebookNL dabei, aber es braucht Erfahrung das gut zu nutzen. Möglicherweise könnte man hier dialogisch vorgehen, genau wie wenn man direkt mit dem LLM arbeitet? Da im Chat von NotebookNL nur die eigenen Quellen genutzt werden, ist es schwer Lücken im Thema zu finden. Möglicherweise muss man parallel noch mit einem LLM direkt arbeiten, dass im Internet recherchieren kann? --Goldzahn (Diskussion) 10:44, 16. Mai 2026 (CEST)
- Wie schon beschrieben, die Quellen selbst auszuwählen und dann im Dialog mit NotebookLM darin zu arbeiten finde ich sinnvoller und zielführender, als sich von NotebookLM welche zusammensuchen zu lassen. Es gibt gute viele gute Datenbanken, in denen man recherchieren kann. Meistens folge ich ohnehin den Verweisen, also von einem interessanten Text aus in die Literaturverweise gehen und dort weiterlesen. --Nina (Diskussion) 11:09, 16. Mai 2026 (CEST)
- Ich suche in bibliographischen Datenbanken wie Base Bielefeld oder Volltextdatenbanken wie Genios Wiso Literatur zu zeitgeschichtlichen Themen. Die KI-Suche von Google funktioniert nach völlig undurchschaubaren technischen Kriterien. NotebookLM hilft nur beim diagonalen Lesen der hochgeladenen Volltexte, indem die relevanten Textabschnitte mittels Fußnoten schnell ansteuerbar sind. --BitterLemon2021 (Diskussion) 10:33, 16. Mai 2026 (CEST)
Ich habe gerade NotebookLM für eine Recherche genutzt. Im letzen Jahr hatte ich mit KI ein Video zum Mond Titan für YouTube produziert gehabt. Als Wikipedianer hatte ich natürlich auf meine Quellen geachtet. Da ich die Audio-Spur auch als Text-Spur angelegt hatte, konnte NotebookLM diese lesen. Ich habe jetzt diese Text-Spur mit dem WP-Artikel Titan auf Widersprüche untersucht und mir anzeigen lassen welche Infos nicht im WP-Artikel angesprochen wurden. Diese Infos habe ich dann per automatisierter Quellensuche (ich habe den Prompt dazu selber formuliert) in NotebookLM (chat) gegenlesen lassen. Die automatisiert gefundenen Quellen waren bei der ausgewählten Profisuche qualitativ passend. Ich weiß nicht ob es einen besseren Arbeitsablauf zur Recherche gibt, wobei der hier gewählte Weg mMn brauchbare Ergebnisse produziert hat. --Goldzahn (Diskussion) 22:45, 17. Mai 2026 (CEST)
- Falls das nicht klar geworden ist, es geht darum ob man einen WP-Artikel effizient in NotebookLM gegenlesen kann. Was offensichlich nicht geht ist die Quellen vom WP-Artikel automatisiert in NotebookLM einzugeben und zu überprüfen ob diese richtig im Artikel wiedergegeben wurden. Ich denke theoretisch ist das möglich - also per Hand -, aber mit Bordmitteln ist das automatisiert nicht möglich. Allein schon deshalb weil kaum ein WP-Artikel mit unter 50 Quellen (dann kostenfrei) auskommt. --Goldzahn (Diskussion) 22:59, 17. Mai 2026 (CEST)
- Vielleicht kann ein Programmierer bei Wikipedia Deutschland einen solchen Workflow in Dify zusammenbauen. --BitterLemon2021 (Diskussion) 06:09, 18. Mai 2026 (CEST)
- Zum Thema Factchecking gab nicht nur seit der FAS-Reportage, sondern auch auf dem KI-Treffen in Berlin einigen Austausch. Wir sollten das mal koordiniert angehen und eine entsprechende Seite hier im Portal eröffnen, da sind bestimmt viele dran interessiert. --Nina (Diskussion) 08:48, 18. Mai 2026 (CEST)
- ich habe Gemini nach Dify AI und der Factchecking-Aufgabe gefragt. Gemini schlägt vor das ohne RAG zu machen und den Text von dem Beleg in den Chatbot zu kopieren und dann mit dem immer gleichen Prompt alle Belege gegen den WP-Artikel laufen lassen. Das soll mit Dify AI automatisiert machbar sein. Die Schwierigkeiten dürfte sein einen derart allgemeinen Prompt zu finden. Zwar schlägt Gemini so einen Prompt vor, aber ob der etwas taugt? Bei 3 Mio Artikel und 100 Belege pro Artikel dürfte entscheidend sein wie gut der Prompt ist, wenn man nicht in falschen Ausgaben der KI ertrinken will. --Goldzahn (Diskussion) 14:41, 18. Mai 2026 (CEST)
- Der Prompt soll etwa so aussehen:
- Du bist ein präziser Faktenchecker. Deine Aufgabe ist es, eine Behauptung aus einem Text mit dem bereitgestellten Inhalt der Quell-Webseite abzugleichen.
- Zu prüfende Behauptung: Text 1
- Inhalt der Quelle: Text 2
- Analysiere, ob die Quelle die Behauptung stützt, ihr widerspricht oder ob die Information in der Quelle gar nicht vorhanden ist.
- ich habe Gemini nach Dify AI und der Factchecking-Aufgabe gefragt. Gemini schlägt vor das ohne RAG zu machen und den Text von dem Beleg in den Chatbot zu kopieren und dann mit dem immer gleichen Prompt alle Belege gegen den WP-Artikel laufen lassen. Das soll mit Dify AI automatisiert machbar sein. Die Schwierigkeiten dürfte sein einen derart allgemeinen Prompt zu finden. Zwar schlägt Gemini so einen Prompt vor, aber ob der etwas taugt? Bei 3 Mio Artikel und 100 Belege pro Artikel dürfte entscheidend sein wie gut der Prompt ist, wenn man nicht in falschen Ausgaben der KI ertrinken will. --Goldzahn (Diskussion) 14:41, 18. Mai 2026 (CEST)
- Zum Thema Factchecking gab nicht nur seit der FAS-Reportage, sondern auch auf dem KI-Treffen in Berlin einigen Austausch. Wir sollten das mal koordiniert angehen und eine entsprechende Seite hier im Portal eröffnen, da sind bestimmt viele dran interessiert. --Nina (Diskussion) 08:48, 18. Mai 2026 (CEST)
- Vielleicht kann ein Programmierer bei Wikipedia Deutschland einen solchen Workflow in Dify zusammenbauen. --BitterLemon2021 (Diskussion) 06:09, 18. Mai 2026 (CEST)
- Ausgabeformat
- Status: [BELEGT / WIDERLEGT / NICHT GEFUNDEN]
- Begründung: Erkläre kurz und sachlich, warum.
- Zitat: Gib den exakten Satz aus der Quelle an, der deine Entscheidung stützt.
- --Goldzahn (Diskussion) 14:47, 18. Mai 2026 (CEST)
Ich habe jetzt einige Podcast für meinen Youtube-Kanal mit NotebookLM produziert. Ich nutze dabei die Moderatoren um meine Recherchen auszugeben. Die KI macht das wirklich sehr gut und es gibt keine Einschränkung - was als Quelle im Notebook angegeben ist, wird genutzt. An der Zahl meiner Besucher ändert das allerdings nichts - weiterhin einstellig pro Video. Interessant ist, dass ein 20 minütiges Video im Durchschnitt nach 2 Minuten beendet wird. Ich vermute das ist bei unseren WP-Artikeln nicht anders. Ein Unterschied könnte machen, dass man WP-Artikel nicht-linear nutzen kann. In der Realität am Smartphone sieht man allerdings nur die Einleitung, eine lange Infobox und dann viele Kapitel-Überschriften. Aus meiner Erfahrung bei Youtube kann ich sagen, dass dieser erste Eindruck darüber entscheidet ob jemand sich dass überhaupt anguckt oder gleich weg ist. Die Infoboxen wurden für den PC erfunden - sie sollten das Loch rechts vom Inhaltsverzeichnis füllen. Das Loch gibt es nicht mehr. Die Ausgestaltung der Einleitung ist sogar noch älter und über Kapitelüberschriften wurde noch nie nachgedacht. Übrigens, ich habe kürzlich mit Gemini über die Gliederung eines Textes für ein RAG gesprochen. Kann man nicht überschätzen! Auch das könnte man von einer KI machen lassen. Vielleicht sogar von NotebookLM? --Goldzahn (Diskussion) 10:55, 23. Mai 2026 (CEST)
- Du sprichst da viele Punkte an, die wir in in unserer kleinen Qualitätsinitiative WP:QUEA auch adressieren. Genau weil die die Lesenden vor allem den Artikelanfang lesen, brauchen wir bessere Einleitungen. An mich wurde auch schon herangetragen, dafür KI zu nutzen. Ich bin aber noch nicht überzeugt, ob und unter welchen Voraussetzungen das im Sinne des Projekts sein könnte. --Nina (Diskussion) 13:27, 23. Mai 2026 (CEST)
- ich habe das Projekt auf meine Beo gesetzt und auch etwas reingeguckt. Ich denke, ich werde erst etwas experimentieren, um zu sehen was NotebookLM einfällt und ob das mMn zu einer Verbesserung führt. Ich werde auf jeden Fall hier berichten was dabei rausgekommen ist, vielleicht auch mit Wikilink auf Vorher / Nachher. --Goldzahn (Diskussion) 14:06, 23. Mai 2026 (CEST)
- Ich habe das mit dem Artikel Aachener Weiher mal getestet. Mir ist aufgefallen, wenn ich im Chat schrieb, dass der Weiher 200 m mal 100 m lang ist, sagte mir die KI, das das falsch sei, weil in den Daten die Größe mit 40.000 m2 angegeben ist. Es wird also alles was ich im Chat von NotebookLM schreibe an den Quellen überprüft - hier der WP-Artikel. Ich denke das lässt sich vielfältig nutzen. Als ich allerdings bei meinem Vorschlag für die Einleitung die Universitätsstraße nannte, wurde das nicht kritisiert, obwohl es nicht in der Quelle stand. Erst als ich konkret danach fragte, sagte die KI, dass das nicht in der Quelle stünde, aber aus eigenem Wissen kann sie das bestätigen.
- Die KI hat an einer Stelle geschrieben: Ein moderner Hook versucht oft, eine Emotion oder eine aktuelle Relevanz zu erzeugen. In der aktuellen Einleitung fehlen die Aspekte, die den Weiher für die Kölner heute so lebendig machen.
- Mir hat das gefallen, weshalb ich die Geschichte des Weihers aus der Einleitung in ein neues Kapitel Geschichte schob und stattdessen die "aktuelle Relevanz" - neben der Lage - in die Einleitung nahm. Ich vermute, wenn jemand diesen Artikel aufruft, dann deshalb. --Goldzahn (Diskussion) 20:08, 23. Mai 2026 (CEST)
- Ich glaube es nicht! Die KI hatte mich bei einem Textvorschlag für eine Einleitung darauf hingewisen, dass eine Sache so nicht in der Quelle (dem WP-Artikel) steht. Ich schrieb dann: "Die Bezeichnung in den Büchern ist aber so, auch wenn es nicht in der Quelle steht." Die Antwort war: "Das ist ein berechtigter Einwand, da die Begriffe Neo-Delfine und Neo-Schimpansen in den deutschen Übersetzungen der Romane tatsächlich die gängigen Bezeichnungen für die Klientenrassen der Menschheit sind. Da das Ziel eine hilfreiche Einleitung für Leser ist, integriere ich diese Begriffe in den Text." Das hatte ich nicht erwartet! An einer anderen Stelle korrigierte NotebookLM einen Kommafehler von mir. Also, Textvorschläge kann sie nicht - was auch nicht erwünscht ist - aber meine Einleitungen gegenlesen, funktioniert sehr gut. Bei Einleitungen ist da nur der WP-Artikel als Quelle, aber ich vermute das klappt genauso gut, wenn man bsw einen Text (bei mir: meine Podcasts) anhand von Quellen neu schreibt. Also, mir gefällt NotebookLM immer besser! Was mir bezüglich der Einleitungen bisher auffiel: Ich hatte mir bisher die Einleitungen von etwa 20 Artikel angesehen und nur bei 3 habe ich mich getraut etwas zu ändern. Ich bin bei "aktueller Relevanz" geblieben, habe allerdings noch ergänzt - für den Leser der Bücher, den Besucher von ... oder ... --Goldzahn (Diskussion) 15:38, 24. Mai 2026 (CEST)
- ich habe das Projekt auf meine Beo gesetzt und auch etwas reingeguckt. Ich denke, ich werde erst etwas experimentieren, um zu sehen was NotebookLM einfällt und ob das mMn zu einer Verbesserung führt. Ich werde auf jeden Fall hier berichten was dabei rausgekommen ist, vielleicht auch mit Wikilink auf Vorher / Nachher. --Goldzahn (Diskussion) 14:06, 23. Mai 2026 (CEST)
Fragwürdige KI-Bilder
Was sind das für seltsame Bilder auf diesen Seiten? Mit dem Bild auf dem Wegweiser oben Humans First mit einer nichthumanen Person, seltsamer Perspektive, in komplett steriler Umgebung ist die Umsetzung des US-amerikanischen Slogans „Humans First“ ja wirklich treffend dargestellt. Bei dem weiteren Meisterwerk hier oben Diskutierende Wikipedianer sitzen zehn zombie-artige Figuren an einem Tisch. Nur keiner von ihnen scheint zu diskutieren, alle starren gebannt auf die Bildschirme ihrer Geräte, in Erwartung was die KI wohl als nächstes ausgeben wird? Interessant ist die Frage, was die Frau hinten rechts für ein Gerät benutzt. Diese absurden Bilder geben einen schönen Einblick in die schöne neue Welt, die von generativer KI geprägt ist. Ist das Ernst gemeint oder bittere Ironie? --~~~~ --~2026-30910-32 (Diskussion) 17:10, 23. Mai 2026 (CEST)
- Welchen Projekt-bezogenen Hinweis sollen andere Benutzer aus deinem Beitrag ziehen, nachdem sie die Zeit verschwendet haben, ihn zu lesen? --Jensbest (Diskussion) 18:59, 23. Mai 2026 (CEST)
- Nach meinem Wissen sind die Bilder entstanden bevor das mit "human first" beschlossen wurde. Wer heute solche Bilder anfertigen und in die WP einbindet wird "gesteinigt". Die Person die das eine Bild beim Projekt einfügte ist erst vor wenigen Tagen für mehrere Monate gesperrt worden und darf nie wieder hier im Projekt mitmachen. Wir nehmen das mit "human first" sehr ernst. PS: Ich habe früher auch mit KI Bilder erstellt - davon distanziere ich mich heute: es war ein schlimmer Fehler. --Goldzahn (Diskussion) 20:17, 23. Mai 2026 (CEST)
- Ich finde den Hinweis berechtigt. Der Ersteller all dieser Bilder (? ich habs nicht geprüft, nehme es nur an) hat wenig Unterstützung im Projekt für seine Vorgehensweise. Ich hatte schon länger überlegt, sie zu entfernen, vielleicht ist die Zeit dafür bald reif. --Nina (Diskussion) 20:28, 23. Mai 2026 (CEST)
- Niemand ist für "Monate gesperrt" worden. Die Bilder sind in einem Wiki-Projekt, nicht im ANR eingefügt, also kann man gerne bei der Diskussion, ob die Bilder passend sind oder andere erstellt werden sollten, auch mal ein wenig entspannen. Das sicher komplett neue und ganz sicher keine TK-Sockenpuppe eines bereits existierenden Benutzers TK benutzt viele abwertende Worte ("Zombie-artig" usw.); es gibt etliche Reallife Fotos von diskutierenden Wikipedainer:innen, die dabei auf Monitore schauen - naja, wie gesagt, viel Stimmungsmache, wenig sachliche Beiträge, Tonfall unterirdisch. Scheint hier bei einigen normal zu werden, wenn sie sich auf KI-Hexenjagd befinden. Die aktuellen Richtlinien beziehen sich auf den ANR, nicht auf andere Namensräume, in denen z.B. die Community rund um Themen oder andere organisiert und austauscht. --Jensbest (Diskussion) 22:34, 23. Mai 2026 (CEST)
- Du weißt schon, das so sprechen unerwünscht ist? Ich glaube das heißt „ad personam“. Beim sachlichen Kern liegst du richtig - allerdings stimmt schon, wenn es heißt "human first" und man bebildert das mit KI-Bildern, dann hat das etwas Falsches. --Goldzahn (Diskussion) 15:53, 24. Mai 2026 (CEST)
- Niemand ist für "Monate gesperrt" worden. Die Bilder sind in einem Wiki-Projekt, nicht im ANR eingefügt, also kann man gerne bei der Diskussion, ob die Bilder passend sind oder andere erstellt werden sollten, auch mal ein wenig entspannen. Das sicher komplett neue und ganz sicher keine TK-Sockenpuppe eines bereits existierenden Benutzers TK benutzt viele abwertende Worte ("Zombie-artig" usw.); es gibt etliche Reallife Fotos von diskutierenden Wikipedainer:innen, die dabei auf Monitore schauen - naja, wie gesagt, viel Stimmungsmache, wenig sachliche Beiträge, Tonfall unterirdisch. Scheint hier bei einigen normal zu werden, wenn sie sich auf KI-Hexenjagd befinden. Die aktuellen Richtlinien beziehen sich auf den ANR, nicht auf andere Namensräume, in denen z.B. die Community rund um Themen oder andere organisiert und austauscht. --Jensbest (Diskussion) 22:34, 23. Mai 2026 (CEST)
- Ich finde den Hinweis berechtigt. Der Ersteller all dieser Bilder (? ich habs nicht geprüft, nehme es nur an) hat wenig Unterstützung im Projekt für seine Vorgehensweise. Ich hatte schon länger überlegt, sie zu entfernen, vielleicht ist die Zeit dafür bald reif. --Nina (Diskussion) 20:28, 23. Mai 2026 (CEST)
Grokipedia
Der NDR hat Grokipedia evaluiert. Grokipedia-Artikel landen auch in den Chatbots ChatGPT und Gemini. "Bei rund 13 Millionen Prompts an ChatGPT sei Grokipedia etwa 260.000-mal zitiert worden... Inwieweit Grokipedia als vertrauenswürdig eingestuft werden kann, wurde von beiden Unternehmen nicht beantwortet. Google und xAI reagierten nicht auf eine NDR-Anfrage." Noch schlimmer wäre es, wenn Grokipedia-Artikel die LLMs trainieren würden. In jedem Fall muss jede in einem Chatbot angezeigte Quelle daraufhin überprüft werden, ob und inwieweit sie KI-generiert ist. --BitterLemon2021 (Diskussion) 05:29, 28. Mai 2026 (CEST)
- Ein Grund, diese Modelle gar nicht mehr zu nutzen. Das mit den KI-generierten Quellen steht ja auch schon in WP:KI, wir sollten darüber nachdenken, das "Ekennbar" aus dem Satz Erkennbar von einem LLM generierte Texte (in anderen Publikationen, z. B. auf externen Websites) sind keine geeigneten Belege für die Artikelarbeit in der Wikipedia zu streichen. --Nina (Diskussion) 09:41, 28. Mai 2026 (CEST)
- Das Problem hierbei scheint mir zu sein, dass über die KI der Ansatz der reputablen Quelle ausgehebelt wird. Das gilt insbesondere deshalb, weil auch wenn in Grokipedia eine Aussage noch mit Quelle angegeben ist, dies bei der Übernahme durch die KI unter den Tisch fällt. Bei uns tauchen dagegen keine un-reputablen Quellen auf, weshalb sie dann auch nicht in die KI einwandern.
- Ich habe jedenfalls noch nie von einer KI gelesen: Person x sagt y. Da heißt es immer, das y sei. Oder liege ich da falsch? --Goldzahn (Diskussion) 07:13, 29. Mai 2026 (CEST)
- Ich habe Gemini gefragt wo die AfD politisch einzuordnen ist und dies war der erste Absatz: "Die Alternative für Deutschland (AfD) wird von Politikwissenschaftlern, Soziologen und Verfassungsschützern im politischen Spektrum als rechtspopulistisch bis rechtsextremistisch eingeordnet." Bei uns sieht die Einleitung zum Lemma aber nicht besser aus, wie ich gerade gesehen habe. Der Artikel dürfte ein "Honigtopf" sein, schätze ich. Ich habe Gemini dann gefragt wo die AfD sich selber politisch einordnet und eine Zusammenfassung erhalten, die ich als NPOV empfinde. Also: Die Partei sagt X, alle anderen sagen Y.
- Also, meine Aussage war hier falsch, wenn auch verallgemeinert wird: "von Politikwissenschaftlern, Soziologen und Verfassungsschützern".
- Ich habe dann die selbe Frage zu Friedrich Merz gestellt und da wird für die politische Einschätzung keine Quelle mehr genannt. --Goldzahn (Diskussion) 07:39, 29. Mai 2026 (CEST)
- Die Formulierung "von Politikwissenschaftlern, Soziologen und Verfassungsschützern" wäre aber allenfalls eine vage Standpunktzuweisung, eine Quelle ist das ja noch nicht. --Nina (Diskussion) 07:49, 29. Mai 2026 (CEST)
- Meine KI - Gemini- nennt gar keine Quellen, insofern ist da mehr wohl nicht machbar. --Goldzahn (Diskussion) 09:27, 29. Mai 2026 (CEST)
- Bei Quellen hat man das Problem welche man nimmt - es gibt ja viele Quellen. Die KIs sparen sich das. Allerdings wird das bei Grokipedia dann zum Problem für eine KI. Ich glaube allerdings, dass Grok gar nicht NPOV sein will, wenn Twitter als Quelle mit herangezogen wird.
- Ich hatte mal Grok zum Schreiben meiner Podcasts probiert gehabt. Ich glaube die Geschichten waren farbiger gewesen. Das hatte mir seinerzeit gefallen. --Goldzahn (Diskussion) 09:39, 29. Mai 2026 (CEST)
- Eben darum ist es ja so wichtig, dass wir keinen KI-generierten Text übernehmen, wie glücklicherweise im Meinungsbild von den meisten erkannt wurde. --Nina (Diskussion) 14:51, 29. Mai 2026 (CEST)
- Meine KI - Gemini- nennt gar keine Quellen, insofern ist da mehr wohl nicht machbar. --Goldzahn (Diskussion) 09:27, 29. Mai 2026 (CEST)
- Die Formulierung "von Politikwissenschaftlern, Soziologen und Verfassungsschützern" wäre aber allenfalls eine vage Standpunktzuweisung, eine Quelle ist das ja noch nicht. --Nina (Diskussion) 07:49, 29. Mai 2026 (CEST)
WikiEdu über "Generative AI and Wikipedia editing"
„Wikipedia editors should never copy and paste the output from generative AI chatbots like ChatGPT into Wikipedia articles.“ --Nina (Diskussion) 09:38, 28. Mai 2026 (CEST)
"Why trusted content matters more than ever"
Das Newsportal Research Information fasst die Debatte gerade passend zusammen . Darin werden die Bedingungen aufgelistet, unter welchen ein KI-Tool den Anforderungen an wissenschaftliche Recherche genügen könnte. --Nina (Diskussion) 16:20, 29. Mai 2026 (CEST)
KI per Token abrechnen
Habt Ihr mitbekommen, dass die Anbieter die Abrechnung umstellen, was so manche KI-Nutzung extrem teuer macht? Ich glaube bei der deutschen Sprache bestehen die Worte oft aus zwei Token. Also lange und viele Texte werden teuer. Ich habe kürzlich gelesen, dass bei einem Gespräch in einen KI-Chat alle Ein- und Ausgaben ein Verbrauch von Token sind. Bei einem RAG werden die Quellen per Token abgerechnet und die KI-Agenten sind Token-Großverbraucher, weil sie schrittweise vorgehen und dabei bei jedem Schritt Token verbrauchen.
Wer kein kostenpflichtiges KI-Abo hat, wie zB ich, soll ein internes Token-Limit haben. Also, wenn man das erreicht pausiert die KI für einige Stunden. Bei NotebookLM ist es so, dass ich nur wenige Audios pro Tag machen kann - vielleicht 5? Dann die 30 Quellen pro Notebook. Möglicherweise kommt zusätzlich noch ein Token-Limit? Also, die Anbieter glaube langsam die wahren Kosten weiter geben zu können ohne das die Kunden abspringen. Man wurd sehen. --Goldzahn (Diskussion) 18:26, 31. Mai 2026 (CEST)
- Natürlich bleibt im Kapitalismus das alles nicht auf Dauer kostenlos. -- Chaddy · D 20:57, 31. Mai 2026 (CEST)
- Irgendwie müssen sie Geld machen. Durch direkte Bezahlung, Werbung, Verkauf von Nutzerdaten oder eine Kombination von allem. Wenn sie sich mehr direkt bezahlen lassen, kann das für uns vielleicht zu einer gewissen Entspannung führen: Weniger Leute werden in Versuchung kommen, hier im grossen Stil KI-generierte Texte einzustellen, wenn sie dafür bezahlen müssen. Also mein Wunsch an die KI-Anbieter: Lasst euch bezahlen, gerne sehr teuer! ;-) --Gestumblindi 21:14, 31. Mai 2026 (CEST)
- Ich glaube nicht das das Schüler betrifft, die mit KI experimentieren. --Goldzahn (Diskussion) 21:32, 31. Mai 2026 (CEST)
- Schülerexperimente sind und waren schon immer eh leicht zu erkennen und abzuräumen, ob mit KI oder ohne erstellt, das ist ja nicht das grosse Problem. --Gestumblindi 21:41, 31. Mai 2026 (CEST)
- Ich glaube nicht das das Schüler betrifft, die mit KI experimentieren. --Goldzahn (Diskussion) 21:32, 31. Mai 2026 (CEST)
- Irgendwie müssen sie Geld machen. Durch direkte Bezahlung, Werbung, Verkauf von Nutzerdaten oder eine Kombination von allem. Wenn sie sich mehr direkt bezahlen lassen, kann das für uns vielleicht zu einer gewissen Entspannung führen: Weniger Leute werden in Versuchung kommen, hier im grossen Stil KI-generierte Texte einzustellen, wenn sie dafür bezahlen müssen. Also mein Wunsch an die KI-Anbieter: Lasst euch bezahlen, gerne sehr teuer! ;-) --Gestumblindi 21:14, 31. Mai 2026 (CEST)
- Du meinst, dass einige Unternehmen, die über APIs arbeiten, intern die Tokennutzung reduzieren? Das wäre ein anderes Thema.--Jensbest (Diskussion) 22:16, 31. Mai 2026 (CEST)
- https://www.it-daily.net/shortnews/github-copilot-zahlt-man-jeden-token Hier ist bsw die Info über die neue Abrechnung auf github. --Goldzahn (Diskussion) 03:39, 1. Jun. 2026 (CEST)
- Naja, das ist ja gut im Sinne einer mehr verantwortlichen und sinnhaften KI-Nutzung. Um mal die Auto-Metapher zu strapazieren: Für Raser auf der Autobahn kostet Benzin jetzt mehr, wird Literweise abgerechnet. Das muss mich, der keinen agentischen Wahnsinn fährt, sondern strukturierte Abfragen zur Artikelanalyse macht nicht interessieren, denn diese sind bereits aufgrund der Anforderungen für die Abfragen und die zugrundeliegenden Daten auf die Aufgabe hin optimiert. Wichtig wird bei der zukünftigen KI-Diskussion die Linien der Entwicklung zu differenzieren. Auf den Unsinn der KI-Slop-artigen, nicht unseren enzyklopädischen Regeln entsprechenden, hingerotzten "Artikeln" wird sich das nicht auswirken, denn diese werden von Personen mit Free-Accounts oder für privaten Gebrauch gekauften Abo-Modellen erstellt. --Jensbest (Diskussion) 09:25, 1. Jun. 2026 (CEST)
- Für KI-Aktivitäten von WMDE und WM könnte es relevant sein. Irgendwelche KI-Tools für uns dürften nicht mehr kommen. Das gilt dann auch für Wikidata und Commons. "Humans first" ist billiger als KI. --Goldzahn (Diskussion) 13:50, 1. Jun. 2026 (CEST)
- Das ist nicht so. KI-Tools, zumindest die, die ich kenne und nutze, haben - insbesondere, wenn sie über API laufen - schon immer einen "Token-Zähler", um dem User zu zeigen, wann er seine monatlich gesetzten Kosten-Limits erreicht. Auch auf der mai-Tagung, auf der ich gerade war, berichteten die dortigen GLAMs, wie die Thematik Token-Nutzung oder ganz allgemein KI-Kosten und damit die Etablierung vernünftiger KI-Nutzung in ihren Häusern umgesetzt wird. Da tut sich einiges. Aus meiner Sicht wird im Wikiverse aktuell mit guter Sachkenntnis an hilfreichen KI-Tools gearbeitet, die auch diesen Aspekt beachten.
- Und nicht vergessen: Mit selbst-gehosteten Modellen, deren Parameter und andere Settings Token-sensibel arbeiten können, wird der ganze Aspekt der Kosten nochmal stark inhouse verlagert und damit gesenkt. Ich würde wetten, dass wir über kurz oder lang für konkrete KI-unterstützte Arbeitsprozesse rund um den "Humans First"-Kern des Schreibens die großen, proprietären LLMs nicht mehr verwenden werden. Und das Gute: Die Prozesse, die aktuell mit diesen ausprobiert und optimiert werden, sind später auch weitestgehend mit anderen Modellen umsetzbar. --Jensbest (Diskussion) 14:30, 1. Jun. 2026 (CEST)
- Für KI-Aktivitäten von WMDE und WM könnte es relevant sein. Irgendwelche KI-Tools für uns dürften nicht mehr kommen. Das gilt dann auch für Wikidata und Commons. "Humans first" ist billiger als KI. --Goldzahn (Diskussion) 13:50, 1. Jun. 2026 (CEST)
- Naja, das ist ja gut im Sinne einer mehr verantwortlichen und sinnhaften KI-Nutzung. Um mal die Auto-Metapher zu strapazieren: Für Raser auf der Autobahn kostet Benzin jetzt mehr, wird Literweise abgerechnet. Das muss mich, der keinen agentischen Wahnsinn fährt, sondern strukturierte Abfragen zur Artikelanalyse macht nicht interessieren, denn diese sind bereits aufgrund der Anforderungen für die Abfragen und die zugrundeliegenden Daten auf die Aufgabe hin optimiert. Wichtig wird bei der zukünftigen KI-Diskussion die Linien der Entwicklung zu differenzieren. Auf den Unsinn der KI-Slop-artigen, nicht unseren enzyklopädischen Regeln entsprechenden, hingerotzten "Artikeln" wird sich das nicht auswirken, denn diese werden von Personen mit Free-Accounts oder für privaten Gebrauch gekauften Abo-Modellen erstellt. --Jensbest (Diskussion) 09:25, 1. Jun. 2026 (CEST)
- https://www.it-daily.net/shortnews/github-copilot-zahlt-man-jeden-token Hier ist bsw die Info über die neue Abrechnung auf github. --Goldzahn (Diskussion) 03:39, 1. Jun. 2026 (CEST)
Also bei natürlichsprachlichen Texten braucht man sich keine Sorgen machen. 1 Million Token, was etwas einem halben Buch entsprich, kosten beim besten Modell vielleicht so einen Dollar. Nur komplexere Anfragen, die mehrere Quellen auswerten, könnten dann schon sehr teuer werden, vor allem wenn man dann noch PDF-Dateien und dergleichen auswerten will. Zur Zeit scheinen die Preise aber wieder zu fallen, weil sich OpenAI und Anthropic gerade einen Preiskampf liefern: --Sinuhe20 (Diskussion) 08:08, 12. Jun. 2026 (CEST)
Was die FAZ so macht
Bei der Frankfurter Allgemeinen gibt es nun eine inhouse entwickelte KI-Suche, die basierend auf den FAZ-Inhalten zusammenhängende Antworten auf die Suchanfragen gibt, inklusive Fußnoten, mit denen man auf die jeweiligen Artikel kommt. Die FAZ betont, dass wurde nicht an externe Technologiekonzerne ausgelagert, sondern als Eigenentwicklung im F.A.Z.-Archiv selbst gebaut wurde. Nur mal so als Inspiration. --Jensbest (Diskussion) 16:48, 1. Jun. 2026 (CEST)
Wie KI-Suche den Wissenserwerb in der Gesellschaft verändert
Gestern gab es organisiert von der DGI und dem Hochschulverband für Informationswissenschaft einen für uns hochrelevanten Vortrag von Dirk Lewandowski zu obigem Thema, hier der Link auf die Folien . KI-Chatbots und Suchmaschinen werden immer mehr miteinander verschmelzen. KI-Halluzinationen werden auf absehbare Zeit nicht verschwinden, und auch standardmäßiger RAG-Einsatz verbessert die Zuverlässigkeit zwar, ist aber bei Weitem keine Garantie für Fehlerfreiheit. Das Wichtigste ist die Schlussfolgerung: Wir brauchen eine sorgfältige Kuratierung der Datenbestände, ergo: diese freihalten von Fehlern, die durch KI eingebracht werden. Nur dann bleibt unser (ich meine Wikipedia) Content überhaupt nützlich. --Nina (Diskussion) 06:30, 9. Jun. 2026 (CEST)
- Interessant ist vielleicht die Meldung, dass chatgpt vom Chat eher weg will, weil das keine Einnahmen bringt. Solange in den KI-Chats keine Werbung geschaltet wird, lohnt sich Chat eigentlich nicht. Ich vermute Google macht das nur um bessere Daten an die Werbekunden zu verkaufen, hat aber kein echtes Interesse daran allgemeines Wissen zu vermitteln. Das könnte bedeuten, dass nur Google auf Dauer einen Chat anbieten wird, der aber zu weniger Werbeanzeigen führen wird - zumindest mit der App. Die kostenlose WP ist womöglich auch für die KI ein Problem. --Goldzahn (Diskussion) 13:08, 9. Jun. 2026 (CEST)
- Danke für diesen Beitrag. Er zeigt tatsächlich, dass jenseits von Hype und Horror eine sachliche Auseinandersetzung stattfindet, die dann auch tatsächliche Herausforderungen aufzeigt. Herausforderungen, die durch klare und ggf. deutliche Regulierung eingehegt werden müssen. Und die dann auf allen Ebenen angegangen werden müssen, um sicherzustellen, dass es auch mit KI eine Zukunft gibt, die es wert ist.
- Das Kuratieren von Datenbeständen ist imho der zentrale Hebel, sowohl auf der Ebene von Organisationen und Unternehmen als eben auch gesellschaftlich, wo dann die Realität der Wikipedia einzahlt.
- Es sollte - nicht von uns, aber anderen - auch mehr getan werden, um von den großen Sprachmodellen wegzukommen, um mit gezielt entwickelten, trainierten und eingesetzten Modellen souveräner arbeiten zu können. Nur so kann diese epistemische Herausforderung so angegangen werden, um Human First sinnvoll durchzuziehen. Für uns bedeutet das imho, dass wir KI-Einsatz als reines Werkzeug weiterentwickeln sollten und die klare Trennlinie wie sie aktuell gesetzt ist, ggf. sogar noch länger durchziehen. Dies dient dem Schutz des Projektes und der Community. Als Projekt des freien Wissens sollten wir dennoch auch versuchen, die interne Meinungsbildung und unsere Position in der Gesellschaft voranzutreiben.
- Ich bin am Überlegen, wie das aussehen könnte, bin bald kurz im Urlaub und hoffe danach einen Vorschlag zur Diskussion stellen zu können. Mal an den harten Kern hier gefragt: Sollten wir, z.B. Ende Juli ein Online-Treffen anvisieren, auf das wir uns vorbereiten und wo wir uns mal wieder in der Runde (wenn auch nur online) austauschen können? --Jensbest (Diskussion) 13:24, 9. Jun. 2026 (CEST)
- Das "kontextuelle Wissen" in LLMs, die durch frei zugänglichen Web-Content trainiert werden, wird in RAG-Systemen bekanntlich gegenüber dem "Expertenwissen" in den Chunks von nicht frei zugänglichen Inhouse-Datenbanken heruntergewichtet. Je mehr das externe LLM durch KI-generierten Web-Content trainiert wird, um so höher die Halluzinationsrate. Das Expertenwissen dürfte also zunehmend hinter Paywalls von Inhouse-Datenbanken verschwinden. Wikipedia wird es als "Zwitter" schwerer haben, noch als qualitätvoller Content im freizugänglichen WWW wahrgenommen zu werden. --BitterLemon2021 (Diskussion) 14:51, 9. Jun. 2026 (CEST)
- Schwer das alles unter Kontrolle zu halten, Wikipedia ist ja genau das Gegenteil von Kuratierung. Das KI-Verbot war schon mal ein wichtiger Schritt, aber ob sich alle daran halten, ist fraglich. Bei der Masse an Artikeln kann glaube ich tatsächlich nur der Einsatz von KI helfen, von KI eingebrachte Fehler aufzudecken und zumindest auf ein Minimum zu halten. Oder man startet halt eine neue Enzyklopädie, die von Anfang an auf kuratierte Inhalte setzt, so wie einst Nupedia mit seinem aufwendigen Peer-Review-Verfahren. --Sinuhe20 (Diskussion) 21:23, 15. Jun. 2026 (CEST)
- Was wir hier machen, ist genau diese Datenkuratierung. Wir versuchen, Wikipedia ausschließlich auf belegten Informationen aufzubauen, und echte Menschen schauen sich die Belege an und treffen anhand dieser die Entscheidung, was bleiben darf und was gehen muss. Dass KI zum Einsatz kommen kann, dabei zu helfen, Fehler zu entdecken, wäre dann nur ein Werkzeug auf dem Weg, dieses Ziel zu erreichen. Wir müssten das nur noch konsequenter umsetzen, es landet immer noch zu viel unbelegtes in den Artikeln. --Nina (Diskussion) 06:56, 16. Jun. 2026 (CEST)
Ich hatte vorhin Gemini wegen des Attentats in Belfast befragt. Antwort: Das ist ein unangemessenes Thema - Ende. Ich hatte dann kein Problem per Google-Suche einen Zeitungsartikel zum Thema zu finden. Also, die Zensur der KI ist auch ein Problem. --Goldzahn (Diskussion) 22:25, 9. Jun. 2026 (CEST)
AI Tools pre-conference on Wikimania
I don't speak German, so apologies for writing in English. SJ Klein and I are organising a pre-conference on AI Tools at this year's Wikimania. I believe that the discussions and tool demos may be of interest to the members of this Wikiproject. Unlike other AI-related events at Wikimania, you don't need a ticket to the conference itself (long sold out) to attend our event as long as you register before July 7 and get train tickets to Paris. More information and the registration link can be found here. --Alaexis (Diskussion) 07:41, 19. Jun. 2026 (CEST)
Cursor
Hat schon mal jemand versucht, Artikel mit dem Tool Cursor zu erstellen oder zu überarbeiten? Man kann es bis zu einem gewissen Kontingent kostenlos nutzen. Den Artikel einfach als artikel.wiki in einen Projektordner ablegen und dann reichen folgende Anfragen "Welches sind die größten Probleme im Wikipedia-Artikel artikel.wiki ?", bei Nachfragen zur Behebung dann "entscheide du" (für die ganz Faulen). Die Probleme werden schrittweise behoben und gleich in der Datei angepasst. Die Qualität und Faktentreue übertrifft so ziemlich alles, was ich bisher ausprobiert habe, obwohl das Tool eigentlich für Programmierer gedacht ist. Allerdings ist das kostenlose Kontingent leider auch sehr schnell aufgebraucht. --Sinuhe20 (Diskussion) 21:35, 19. Jun. 2026 (CEST)
- Von unserer KI-Policy wäre das Vorgehen aber nicht gedeckt? Welche Datenquellen nutzt Cursor zum Faktenabgleich?--Nina (Diskussion) 21:49, 19. Jun. 2026 (CEST)
- Nein, das ist natürlich nur zum theoretischen Ausprobieren. Cursor sucht sich selbständig die bestmöglichen Quellen. Schwache Quellen wie private Webseiten werden erkannt und er sucht dann nach besseren Alternativen usw. --Sinuhe20 (Diskussion) 22:03, 19. Jun. 2026 (CEST)
Übrigens klappt es auch mit dem KI-Softwarewerkzeug Claude Code. Nicht nur um Inhalte in Artikeln zu verändern, sondern man kann damit auch alle anderen Eingriffe im Wikitext vornehmen. "Entferne doppelte Leerzeilen", "Sortiere die Kategorien alphabetisch", "Konvertiere alle Inline-Referenzen in ein einheitliches <ref name="...">-System mit Wiederverwendung identischer Quellen.", "erstelle aus dem englischen Wikipedia-Artikel eine deutsche Fassung (inklusive automatischer Transformation aller Vorlagen)" usw. D.h. man formuliert nur noch seine Wünsche und Ziele, muss aber nicht mehr aufwendige Editier-Operationen direkt im Wikicode vornehmen. --Sinuhe20 (Diskussion) 19:25, 24. Jun. 2026 (CEST)
Hier mal eine Demonstration, wie ich versucht habe, den französischen Artikel fr:Château de Victot mit Cursor nach dewiki zu übertragen. Das aktuelle Ergebnis liegt unter Benutzer:Sinuhe20/Château de Victot. Ich habe dabei keine einzige Zeile des Wikitextes selbst verändert (bis auf den Baustellen-Baustein und die Auskommentierung der Kategorien). Dazu hatte ich den Artikel zuerst lokal unter Château de Victot_fr.wiki gespeichert und folgende Prompts abgesetzt, wobei dann immer die visuelle Kontrolle auf Fehler im Browser erfolgte:
- überführe den französischen Wikipedia-Artikel @
Château de Victot_fr.wikiin eine deutsche Fassung - Was stimmt mit @
Château de Victot_de.wikinoch nicht und müsste noch korrigiert werden? - Die Vorlage:Baustein existiert nicht.
- Im Abschnitt "Literatur" gibt es einen Fehler:
Arcisse de Caumont: Statistique monumentale du Calvados. Arrondissement de Pont-l’Évêque. Band 4. Hardel, Caen 1862, S. 145 (französisch, Es muss mindestens einer der beiden Parameter „Suchbegriff“ oder „BuchID“ ausgefüllt werden. Bitte beachte die in der Vorlage:Google Buch befindliche Dokumentation und prüfe die verwendeten Parameter. Fehler bei Vorlage * Parametername unbekannt (Vorlage:Google Buch): "1"). - der verlinkte Artikel "Monument historique (Frankreich)" existiert nicht
- Welche Probleme gibt es noch in @
Château de Victot_de.wiki?
Dann war mein freies Kontingent am Ende. Leider ging es nicht ohne Fehler und ohne weiter nachzufragen, aber ich hatte auch das günstige Modell "Composer 2.5 Fast" ausgewählt. Interessant ist aber, dass schon nach der ersten Anfrage die meisten französischen Vorlagen in deutsche Varianten konvertiert wurden (Infobox Bauwerk (eine Vorlage:Infobox Schloss existiert ja nicht mehr), Internetquelle, Literatur). Artikel wurden zwar selbstständig verlinkt, einige Linkziele haben aber nicht gepasst und die Verlinkung auf französische Wikipedia-Artikel ist ja eigentlich auch tabu. Dann hat er noch selbstständig im Web recherchiert und einige Texte ergänzt, was eigentlich nicht erwünscht war (da müsste ich den Anfangs-Prompt noch mal anpassen). Das gesamte Protokoll kann unter Datei:Cursor fr de Château de Victot Protokoll.pdf nachgelesen werden. --Sinuhe20 (Diskussion) 20:57, 24. Jun. 2026 (CEST)
- Du beschreibst eine technische Übertragung des Artikels in Deutsche, wo bleibt die inhaltliche Prüfung? Auf die kommt es ja schließlich an. --Nina (Diskussion) 08:32, 1. Jul. 2026 (CEST)
KI-Erkennungssoftware
Wegen der KI-Verfehlungen von deutschen Journalisten und Politikern wird zur Zeit viel über das KI-Erkennungs-Tool Pangram berichtet. --BitterLemon2021 (Diskussion) 17:59, 20. Jun. 2026 (CEST)
- Das stimmt. Nach den Erfahrunge mit GPTzero, das wirklich total unbrauchbar ist, traue ich den Tools generell nicht mehr über den Weg. KI-Erkennungssoftware wäre ein wichtiger Artikel, der einen Überblick geben könnte. --Nina (Diskussion) 18:03, 20. Jun. 2026 (CEST)
- Es gibt keine KI-Erkennung. Diese Tool arbeiten selbst nur mit Wahrscheinlichkeiten und Mustern. Das ist - auch bei Pangram - immer nur ein vermuten, mehr nicht. Diese Tolls richten mehr Schaden und Zwietracht an, als dass ihre im besten Fall als Indiz zu wertenden Outputs einen Beweis bringen. Auch hier ist durch die mehr Schaden und Streit als auch nur eine tatsächliche Beweisführung entstanden. —Jensbest (Diskussion) 19:17, 20. Jun. 2026 (CEST)
- Jetzt wird's ernst, selbst Thomas Mann soll laut dem Tool KI benutzt haben: . --Sinuhe20 (Diskussion) 23:32, 20. Jun. 2026 (CEST)
- Es ist schade, dass die Zeitungen ihre Argumentation auf diesen Tools aufbauen. Die falschen Zitate und furchtbaren Formulierungen hätten schon ausgereicht. Ich bitte Euch alle, unsere Seite WP:Anzeichen für KI-generierte Inhalte gemeinsam weiterzuentwickeln und zu pflegen. Gestumblindi und ich haben damit begonnen, Feedback ist willkommen. --Nina (Diskussion) 08:22, 21. Jun. 2026 (CEST)
- Guter Vorschlag, es gibt ja Wege die Einsteller von wahrscheinlich mit Hilfe von KI erstellte Texte Fall-spezifisch anzusprechen und dann geeignete Prozesse zu haben, ob der Ersteller mitmacht oder nicht. Dafür hilft diese Liste sicher. Hilfreich wäre natürlich auch eine gewisse Entspanntheit. Jemanden, egal ob neuer oder alter Benutzer, anzuspringen, weil hinter irgendeinem Link „via ChatGPT gefunden“-Kennung dranhängt, ist definitiv nicht hilfreich. Und dies „DU HAST KI BENUTZT, du bist jetzt GESPERRT.“ ist auch kein gangbarer Weg oberhalb von billigem AI-Slop. Aber ich bin mir sicher, dass wir dabei sind, bessere Wege gerade zu finden. —Jensbest (Diskussion) 08:37, 21. Jun. 2026 (CEST)
- Nachfragen muss erlaubt sein, ohne dass die Personen sich sofort verurteilt fühlen. Sperren sind ja nur das letzte Mittel und kommen nur bei krassen Verstößen vor. Deren Androhung finde ich allerdings auch nervig, vielleicht sollten wir den Baustein entsprechend etwas abmildern. --Nina (Diskussion) 11:40, 21. Jun. 2026 (CEST)
- Absolut, wir sehen ja aktuell beim Benutzer Schnimo und dem Airlaid-Artikel, dass das mit großer Wahrscheinlichkeit auf eine Entfernung des Artikels aus dem ANR und einer möglichen finalen Ansprache des Benutzers, bei fortgesetztem Überhaupt-Nicht-Reagieren, hinauslaufen wird. Diese mehrstufige Ansprache, die von einigen sicher als Perlen vor die Säue angesehen werden wird, sollten wir mehr und mehr als Prozess automatisieren, um die auftretenden Fälle auch bei Peaks ressourcen-schonend bearbeiten können. --Jensbest (Diskussion) 22:08, 24. Jun. 2026 (CEST)
- Es sollte mehr Energie darin investiert werden Faktenfehler aufzuspüren, anstatt nur KI-Nutzung. Letzteres kann zwar ein Indiz für die Generierung falscher Fakten sein, aber keine zwingende Voraussetzung. Wenn sich ein KI-generierter Text auch wie einer liest, ist das natürlich auch nicht gut. --Sinuhe20 (Diskussion) 12:19, 21. Jun. 2026 (CEST)
- Nachfragen muss erlaubt sein, ohne dass die Personen sich sofort verurteilt fühlen. Sperren sind ja nur das letzte Mittel und kommen nur bei krassen Verstößen vor. Deren Androhung finde ich allerdings auch nervig, vielleicht sollten wir den Baustein entsprechend etwas abmildern. --Nina (Diskussion) 11:40, 21. Jun. 2026 (CEST)
- Guter Vorschlag, es gibt ja Wege die Einsteller von wahrscheinlich mit Hilfe von KI erstellte Texte Fall-spezifisch anzusprechen und dann geeignete Prozesse zu haben, ob der Ersteller mitmacht oder nicht. Dafür hilft diese Liste sicher. Hilfreich wäre natürlich auch eine gewisse Entspanntheit. Jemanden, egal ob neuer oder alter Benutzer, anzuspringen, weil hinter irgendeinem Link „via ChatGPT gefunden“-Kennung dranhängt, ist definitiv nicht hilfreich. Und dies „DU HAST KI BENUTZT, du bist jetzt GESPERRT.“ ist auch kein gangbarer Weg oberhalb von billigem AI-Slop. Aber ich bin mir sicher, dass wir dabei sind, bessere Wege gerade zu finden. —Jensbest (Diskussion) 08:37, 21. Jun. 2026 (CEST)
- Es ist schade, dass die Zeitungen ihre Argumentation auf diesen Tools aufbauen. Die falschen Zitate und furchtbaren Formulierungen hätten schon ausgereicht. Ich bitte Euch alle, unsere Seite WP:Anzeichen für KI-generierte Inhalte gemeinsam weiterzuentwickeln und zu pflegen. Gestumblindi und ich haben damit begonnen, Feedback ist willkommen. --Nina (Diskussion) 08:22, 21. Jun. 2026 (CEST)
Der Trend geht zum "Texte selber schreiben"
Immer mehr Redaktionen entscheiden sich wieder fürs Texte-selber-schreiben. Der Spiegel fährt seine KI-Nutzung zurück: . Man könnte fast behaupten, wir sind Trendsetter. --Nina (Diskussion) 17:56, 26. Jun. 2026 (CEST)
- Danke für den Hinweis. Dass allerdings selbst solche „internen“ Artikel hinter der Bezahlschranke liegen, verstehe ich nicht. --Troubled @sset [ Talk ] 18:44, 26. Jun. 2026 (CEST)
- Ja, total schade. Auch interessant in dem Zusammenhang ist der Text von Thomas Knüwer, in dem er schreibt „Generative KI ist eine Massenpsychose“. --Nina (Diskussion) 19:22, 26. Jun. 2026 (CEST)
- Hier mehr zum Inhalt des Spiegel-Artikels: . Dort wird auch eine Studie der Financial Times erwähnt, nach der 70 Prozent der Leserinnen und Leser menschliche Texte vorziehen. --Sinuhe20 (Diskussion) 07:13, 27. Jun. 2026 (CEST)
- Danke auch für diesen Tipp. Besonders absurd finde ich ja, dass CR Kurbjuweit in seinem Essay anscheinend angekündigt hat, dass „Änderungen an den Regeln künftig transparent kommuniziert“ werden sollen – hinter der Bezahlschranke … Troubled @sset [ Talk ] 08:55, 27. Jun. 2026 (CEST)
- Ein Zitat aus dem Spiegelkommentar von Kurbjuweit hat mir gefallen: "Die KI kann uns beim Übersetzen fremder Sprachen helfen, bei der Rechtschreibung, als Unterstützung beim Fact-Checking, bei der Recherche im Internet, bei der Auswertung großer Datenmengen, vielleicht irgendwann auch bei Kurzfassungen eigener Texte. Aber wir müssen aufpassen. Gerade die tiefe Recherche zeichnet den SPIEGEL aus, sie ist die Grundlage für unser Bild von der Wirklichkeit, auch von verborgener Wirklichkeit. Die KI kann irren, kann uns täuschen. Deshalb müssen wir alles überprüfen, was sie uns anbietet. Hier sind wir auch TÜV." --BitterLemon2021 (Diskussion) 09:24, 27. Jun. 2026 (CEST)
Wie generative KI Forschung kontaminiert
Wie groß die Gefahren unreflektierte KI-Nutzung in der Forschung ist, wird in diesem Artikel in Science beschrieben . Öffentlich zugängliche Patientendaten werden verwendet, um mit fehlerhaften Methoden Schlussfolgerungen zu ziehen, die scheinbar interessant oder signifikant wirken. Peer Review ist manchmal überfordert, das zu erkennen. Wenn solche falschen Ergebnisse dann später in Übersichtsarbeiten oder sogar Leitlinien einfließen, kann man sich vorstellen, welche Probleme verursacht werden. Wenn solche Studien aber als fehlerhaft erkannt werden, werden sie zurückgezogen. Das schreibe ich hier, weil wir in Wikipedia zitierte Retractions kennzeichnen sollten. Ich habe unter Wikipedia_Diskussion:Belege#Retractions_kennzeichnen Vorschläge gemacht, es interessiert aber niemanden. Vielleicht möchte sich jemand dazu äußern? --Nina (Diskussion) 19:45, 27. Jun. 2026 (CEST)
Lasst uns fast alle Unterseiten löschen
Genies beherrschen ja bekanntlich das Chaos, aber diese Seite sollte auch Normalsterblichen zugänglich sein. "Wegweiser" enthält einen Link auf "Wegweiser 2" - sowas sollte es in keiner Pfadstruktur geben! Ich vermute, dass die unübersichtliche Struktur einerseits daher kommt, dass die Seite organisch aus einer Benutzerseite erwachsen ist, andererseits durch die Zielsetzung "Themen sind Auswirkungen generativer KI auf Arbeitsweise, Qualitätssicherung und Regelwerk der Wikipedia heute und morgen.", die eher nach allgemeinem Diskussionsforum denn nach zielgerichteter Arbeit klingt.
Mein Verfahrensvorschlag wäre,
- eine Entscheidung zu treffen, ob "Erproben von KI-Modellen" und "Erkennen von KI-generierten Inhalten" wirklich Aufgaben sind, die auf der gleichen Projektseite verwaltet werden sollten (mMn nicht), oder ob man die nicht z.B. lieber in eine offizielle Seite zur Durchsetzung der Regeln und eine Spaßseite aufteilt
- alle Unterseiten, die hier nicht ausschließlich dem Projektziel dienen, in einen BNR zu schieben oder zu löschen
- dafür zu sorgen, dass alle Unterseiten über die Navigationsleiste erreichbar sind, dabei sollten die Titel angepasst werden
- zu jeder Unterseite deren Zielsetzung oben definieren und eine Diskussionsseite anzulegen
- die Regeln und Bausteine prominenter verlinken, Vorgehensweisen aufschreiben
--Entinator (Diskussion) 23:55, 30. Jun. 2026 (CEST)
- Das wäre alles sehr wünschenswert. Es laufen Löschanträge zu einigen Unterseiten: Wikipedia:Löschkandidaten/14._Mai_2026#Unterseiten_von_Wikipedia:WikiProjekt_KI_und_Wikipedia, aber ich weiß gar nicht, ob diese Seiten überhaupt noch eingebunden sind in die diversen "Wegweiser", für mich war das Wikiprojekt schon lange unbrauchbar wegen des Wildwuchses. Eine Neuaufstellung ist eigentlich geplant, ich warte ( mit Gestumblindi) die Entscheidung über die zu löschenden bzw. zu verschiebenden Seiten ab. --Nina (Diskussion) 08:59, 1. Jul. 2026 (CEST)
- Vielen Dank für den Hinweis, mir war gar nicht klar, dass man auch bei Projektseiten Löschanträge stellen muss. Die Wegweiser verlinken noch auf eine Reihe weiterer Unterseiten, die nicht zur Löschung vorgeschlagen und nicht in der Navigationsleiste verlinkt sind. Sinnvoll finde ich es aber nicht, dass ein Admin darüber (nicht) entscheidet, statt der Leute, die mit den Projektseiten arbeiten (wollen).
- Was denkt ihr denn bezüglich der erste Frage, was das Ziel dieses Projekts sein soll?
- So wie ich es sehe, dienen die Unterseiten momentan folgenden Tätigkeiten:
- Meldung von Verdachtsfällen,
- Koordination von Prüfungstätigkeiten
- Austausch zu allgemeinen Diskussionsthemen,
- und vor allem der Materialsammlung zu verschiedenen, KI betreffenden Themen
- und die behandeln alles von gesellschaftlichen Auswirkungen, über den Umgang mit KI-generierten Inhalten in Schwesterprojekten, Versuchen der Artikelerstellung mit KI, bis zum Erkennen von regelwidrig erstellten Artikeln.
- --Entinator (Diskussion) 17:52, 5. Jul. 2026 (CEST)
- Die Struktur sollte auch irgenwie die Anwendungsseite berücksichtigen. Als gutes Beispiel für ein technologiebezogens Wikiprojekt würde ich die WP:Grafikwerkstatt mal anschauen. Deswegen fände ich eine Unterseite "Prompting & Tipps" gut. Es gibt zwar Wikipedia:WikiProjekt KI und Wikipedia/Werkzeuge aber das ist abschweifend mit viel Materialsammlung und "Allgemeinwissen" wie die Erklärung des CRAP-Tests. Etwas umfangreich finde ich Benutzer:Sinuhe20/QS mit KI oder meine kompaktere Variante unter Benutzer:Powercycler/Prompting. --Powercycler (Diskussion) 07:38, 8. Jul. 2026 (CEST)
- Stimme allen Punkten vollkommen zu, bin inhaltlich aber eher eine Niete. Wenn es aus technischer oder gestalterischer Umsetzungssicht Hilfe benötigt, bin ich gerne zur Stelle. LG; --VECTR¹⁹³ONATOR (DISK) 18:39, 8. Jul. 2026 (CEST)
Ich glaube weniger ist an der Stelle mehr. Das Thema KI ist so komplex, dass man sich eher einen guten und klaren Überblick bzw. Einstieg wünscht, anstatt dutzende Unterseiten mit tieferen, nie endenden Erörterungen und Sammlungen. --Sinuhe20 (Diskussion) 19:27, 8. Jul. 2026 (CEST)
- Da sind wir uns einig. Meine Rede. --Gestumblindi 20:43, 8. Jul. 2026 (CEST)
Ich verweise hier auch gern nochmal auf das Portal:Künstliche Intelligenz, bei dem es um die inhaltliche Aufarbeit von KI-Themen in der Wikipedia gehen soll. Die Seite Wikipedia:WikiProjekt KI und Wikipedia ist dort über einen eigenen Reiter eingebunden und ich bin ebenfalls der Meinung, dass hier einiges zurückgeschnitten und evtl. neu konzipiert werden sollte - aktuell laden die Seiten weder zur Information noch zur Mitarbeit ein. -- Achim Raschka (Diskussion) 18:44, 10. Jul. 2026 (CEST)
Kommentar: Ist das KI?
Hallo zusammen,
Wenn ich auf die KI-Clean-up Seite schaue, sehe ich, entlarvt sich KI-Nutzung meist durch Schlampigkeit als Erkennungmerkmal. Dem möchte ich mal ein einfaches Beispiel mit soliden Wikipedia-Konformem Resultat gebenüberstellen.
Gemini Flash 3.1 Extended für Deep Research
Benutzer:Powercycler/Arbeitskopie Siegfried Zell vs. Siegfried Zell (mutmaßlich KI-generiert durch (Benutzer Huhu Uet)
Minimale Prompts zur Korrektur
- Recherchiere einen Wikipedia-Artikel über Siegfried Zell
- Nutze prägnate Formulierung
- Überführe in Wikisyntax in eine Codeblock
- Quelle ans Sterbedatum
So erkennt man kaum noch einen Unterschied zu einem von Menschen geschriebenen Artikel. Alles in 10 Minuten.
(Nur eine Kommentar, nicht als Diskussion gedacht) --Powercycler (Diskussion) 09:49, 12. Jul. 2026 (CEST)
- Rückmeldung zu deinem Eintrag: Hast Du in Siegfried Zell: Engelbergbasistunnel – Tunnelinnenschale. In: Vorspannung mit nachträglichem Verbund. 2000 (DNB-Eintrag). denn nachgelesen, ob die Aussagen korrekt sind? Oder überhaupt irgendeine angegebene Quelle überprüft? --Nina (Diskussion) 10:10, 12. Jul. 2026 (CEST)
- Genau - häufig ist es ja nicht oberflächlich zu erkennende "Schlampigkeit", die KI enttarnt, sondern es sind Belege, die entweder nicht existieren oder das zu Belegende nicht belegen. Hier wären also in der Tat die Quellen zu prüfen. --Gestumblindi 10:25, 12. Jul. 2026 (CEST)
- Ok da muss man die KI zwingen ihre eigenen Quellen zu prüfen... sonst war alles im Interpretationsspielraum. --Powercycler (Diskussion) 10:28, 12. Jul. 2026 (CEST)
- Was ich mit meinem Kommentar sagen will ist, das die KI alleine schon sehr weit kommt. Mit Erfahrung für die schwächen und Sorgfalt steigt die Qualität der Ergebnisse. Es wird kaum noch unterscheidbar von von Menschen recherierten Artikeln. --Powercycler (Diskussion) 10:30, 12. Jul. 2026 (CEST)
- Ich habe neulich einen Artikel zu 100% selbst verfasst, nur wenige Quellen, ansonsten 1 kurze Seite, viel Arbeit, offline vorformuliert, hat man dann sofort gelöscht mit dem (apodiktischen) Hinweis, ganz klar erkennbar mit KI geschrieben. Keine Diskussion, keine Antwort. So gewinnt die KI auf jeden Fall. --~2026-40042-56 (Diskussion) 18:54, 16. Jul. 2026 (CEST)
- Was ich mit meinem Kommentar sagen will ist, das die KI alleine schon sehr weit kommt. Mit Erfahrung für die schwächen und Sorgfalt steigt die Qualität der Ergebnisse. Es wird kaum noch unterscheidbar von von Menschen recherierten Artikeln. --Powercycler (Diskussion) 10:30, 12. Jul. 2026 (CEST)
- Pangram meint, der Artikel Siegfried Zell sei in der Erstversion 100 % Human written. --KurtR (Diskussion) 12:26, 12. Jul. 2026 (CEST)
- Pangram.com kann nichts. Deren Kriterien sind wahrscheinlich eher trivial. Wenn man der KI vorgibt, das der Text sachlich gehalten werden soll und die Füllwörter ausbleiben ist da nichts mehr unterscheidbar. --Powercycler (Diskussion) 12:48, 12. Jul. 2026 (CEST)
- Klar kann man AI-Erkennungsprogramme austricksen. Mein Hinweis war als zusätzliche Info gedacht, kein abschliessendes Urteil über den Artikel. --KurtR (Diskussion) 13:06, 12. Jul. 2026 (CEST)
- Pangram.com kann nichts. Deren Kriterien sind wahrscheinlich eher trivial. Wenn man der KI vorgibt, das der Text sachlich gehalten werden soll und die Füllwörter ausbleiben ist da nichts mehr unterscheidbar. --Powercycler (Diskussion) 12:48, 12. Jul. 2026 (CEST)
- Was Gestumblindi sagt- und wovon ich auch andauernd rede: Die einzige Möglichkeit, zu erkennen, ob KI genutzt wurde oder nicht, ist die Quellen zu prüfen. "Sehr weit" ist ja relativ- wenn nicht sämtliche Aussagen korrekt belegt sind, sind beide Varianten gleich schlampig, nur Deine ist schwerer zu erkennen. Wikipedia-konform ist sie nullkommagarnicht. --Nina (Diskussion) 13:08, 12. Jul. 2026 (CEST)
- Der Ersteller des Artikels wurde bereits für den Artikelnamensraum infinit gesperrt wegen KI, durch Benutzer:Holder. Hätte man den Artikel daraufhin nicht verschieben bzw. löschen sollen/müssen? --KurtR (Diskussion) 13:21, 12. Jul. 2026 (CEST)
- Muss nur jemand machen. Der Fall liegt im KI Clean-up. --Powercycler (Diskussion) 13:40, 12. Jul. 2026 (CEST)
- Ok. Ich dachte, das wäre dann bereits eine Entscheidung auf Adminebene gewesen. --KurtR (Diskussion) 13:53, 12. Jul. 2026 (CEST)
- Es wäre super, wenn jemand die Schnellöschanträge auf alle Artikel stellen könnte. sind denn auch noch Edits im ANR übrig, die keine Neuanlagen sind? --Nina (Diskussion) 14:17, 12. Jul. 2026 (CEST)
- Langsam vor so einer grossen Aktion. Zuerst braucht es einen Konsens hier. Auch muss gesprüft werden, ob Artikel überarbeitet wurden. --KurtR (Diskussion) 14:36, 12. Jul. 2026 (CEST)
- Das kann unter Wikipedia:WikiProjekt_KI_und_Wikipedia/Cleanup#Huhu_Uet besprochen werden, wir wissen ja noch nicht mal, wann mit dem KI-Einsatz begonnen wurde. --Nina (Diskussion) 17:35, 12. Jul. 2026 (CEST)
- Am 6. Januar 2026 hatte er fast im Minutentakt viele Artikel angelegt, die offensichtlich KI sind. Pangram kommt bei drei Stichproben (Willi Wegner, Franz Wegner (Widerstandskämpfer), Heisterkampstraße) zum Resultat 100 % KI-generiert. Da kann ein SLA ohne Probleme hin. Genau an diesem Datum um 22:31 Uhr wurde er auf KI angesprochen:Benutzer_Diskussion:Huhu_Uet#Informationen_zur_Verwendung_von_KI-generierten_Texten_in_der_Wikipedia. Danach hat er diese offensichtlichen KIs eingestellt. Die späteren Artikel sind weniger offensichtlich.
- Ich schreib mein Ergebnis auf Wikipedia:WikiProjekt_KI_und_Wikipedia/Cleanup#Huhu_Uet. --KurtR (Diskussion) 02:41, 13. Jul. 2026 (CEST)
- Das kann unter Wikipedia:WikiProjekt_KI_und_Wikipedia/Cleanup#Huhu_Uet besprochen werden, wir wissen ja noch nicht mal, wann mit dem KI-Einsatz begonnen wurde. --Nina (Diskussion) 17:35, 12. Jul. 2026 (CEST)
- Langsam vor so einer grossen Aktion. Zuerst braucht es einen Konsens hier. Auch muss gesprüft werden, ob Artikel überarbeitet wurden. --KurtR (Diskussion) 14:36, 12. Jul. 2026 (CEST)
- Es wäre super, wenn jemand die Schnellöschanträge auf alle Artikel stellen könnte. sind denn auch noch Edits im ANR übrig, die keine Neuanlagen sind? --Nina (Diskussion) 14:17, 12. Jul. 2026 (CEST)
- Ok. Ich dachte, das wäre dann bereits eine Entscheidung auf Adminebene gewesen. --KurtR (Diskussion) 13:53, 12. Jul. 2026 (CEST)
- Muss nur jemand machen. Der Fall liegt im KI Clean-up. --Powercycler (Diskussion) 13:40, 12. Jul. 2026 (CEST)
- Der Ersteller des Artikels wurde bereits für den Artikelnamensraum infinit gesperrt wegen KI, durch Benutzer:Holder. Hätte man den Artikel daraufhin nicht verschieben bzw. löschen sollen/müssen? --KurtR (Diskussion) 13:21, 12. Jul. 2026 (CEST)
- Was Gestumblindi sagt- und wovon ich auch andauernd rede: Die einzige Möglichkeit, zu erkennen, ob KI genutzt wurde oder nicht, ist die Quellen zu prüfen. "Sehr weit" ist ja relativ- wenn nicht sämtliche Aussagen korrekt belegt sind, sind beide Varianten gleich schlampig, nur Deine ist schwerer zu erkennen. Wikipedia-konform ist sie nullkommagarnicht. --Nina (Diskussion) 13:08, 12. Jul. 2026 (CEST)
Namenskürzung?
Im Rahmen der Neustrukturierung hier fände ich eine Kürzung des Projekttitels sinnvoll. Wikipedia:WikiProjekt KI und Wikipedia beinhaltet, wenn auch technischer Natur, ganze dreimal die Wikipedia und nur zwei Buchstaben erklären, worum es eigentlich geht. Reicht Wikipedia:WikiProjekt KI denn nicht aus? Dass es sich nicht um ein Forum zur KI und dessen Anwendungsarten handelt, sollte aus der Landingpage sowieso einhergehen. LG; --VECTR¹⁹³ONATOR (DISK) 21:49, 12. Jul. 2026 (CEST)
- Pro Zustimmung, sollte kürzer gemacht werden. --KenTheGuru (Diskussion) 16:47, 7. Aug. 2026 (CEST)
- Gegen eine Umbenennung habe ich nichts einzuwenden. Wir sind ja auch noch mitten im Überarbeitungsprozess, was das Projekt eigentlich soll/will, nachdem die Seiten von dem Wortulo-Ballast schon teilweise befreit wurden. --Nina (Diskussion) 17:54, 7. Aug. 2026 (CEST)
- @Chaddy @KurtR @Powercycler @Jensbest @Gestumblindi sicherheitshalber mal gepingt; dann würde ich das bald umsetzen. Auf Wikipedia:WikiProjekt KI und Wikipedia verlinken allein 599 Einträge. Sollten die automatischen Weiterleitungen nach dem Verschieben bestehen bleiben oder die Links per Bot allesamt geändert werden? LG; --VECTR¹⁹³ONATOR (DISK) 20:19, 7. Aug. 2026 (CEST)
- Nichts einzuwenden gegen Umbenennung und Bot-Linkfix... --Gestumblindi 20:26, 7. Aug. 2026 (CEST)
- Passt so. Und gerne Bot-Linkfix -- Chaddy · D 20:30, 7. Aug. 2026 (CEST)
- @Chaddy @KurtR @Powercycler @Jensbest @Gestumblindi sicherheitshalber mal gepingt; dann würde ich das bald umsetzen. Auf Wikipedia:WikiProjekt KI und Wikipedia verlinken allein 599 Einträge. Sollten die automatischen Weiterleitungen nach dem Verschieben bestehen bleiben oder die Links per Bot allesamt geändert werden? LG; --VECTR¹⁹³ONATOR (DISK) 20:19, 7. Aug. 2026 (CEST)
- Gegen eine Umbenennung habe ich nichts einzuwenden. Wir sind ja auch noch mitten im Überarbeitungsprozess, was das Projekt eigentlich soll/will, nachdem die Seiten von dem Wortulo-Ballast schon teilweise befreit wurden. --Nina (Diskussion) 17:54, 7. Aug. 2026 (CEST)
Handhabung KI-Artikel: Verschiebung in BNR statt löschen?
Was spräche eigentlich dagegen, KI-Verdachte erstmal zur Überarbeitung dem Ersteller in den BNR zu schieben? Dort hat er und andere dann die Chance zu entscheiden, ob der Artikel "zu retten" ist, "Substanz" hat oder weg muss? In vielen Fällen sind durch KI die Artikel ja voller falscher Quellen, erfundener Details und und aufgepumpten Formulierungen. Aber oft finden sich ja auch viele Eckpunkte, die man weiterverwenden kann. Wäre im Sinne der Sache doch sicher fairer, als alles auf null zu setzen und ggf. den Rotlink zu behalten? --KenTheGuru (Diskussion) 16:51, 7. Aug. 2026 (CEST)
- So wurde/wird es ja auch schon oft gemacht. --Nina (Diskussion) 17:05, 7. Aug. 2026 (CEST)
- Ah, okay, ich hab jetzt viel gesehen/nachgelesen, dass einfach gelöscht bzw. zurückgesetzt wurde. --KenTheGuru (Diskussion) 17:08, 7. Aug. 2026 (CEST)
- KI-Artikel sind grundsätzlich verboten. Löschen ist die einzig sinnvolle Option. Wir wollen auch nicht etwas überarbeiteten KI-Artikel. Wir wollen gar keine KI-Artikel. -- Chaddy · D 17:19, 7. Aug. 2026 (CEST)
- Das ist richtig, aber es ging ja um KI-Verdacht- und an anderer Stelle geht es um die Vorwürfe, dass nur behauptet werden muss, dass irgendwo genKI zum Einsatz kam, und schon wird gelöscht. Das Zwischenparken im BNR ist daher nicht immer die schlechteste Option, bis geklärt werden kann, ob der/die Autor*in willens und in der Lage ist, einen sorgfältig belegten Artikel zu schreiben. --Nina (Diskussion) 17:51, 7. Aug. 2026 (CEST)
- Sehe ich ähnlich: Eindeutige bzw. bereits geklärte Fälle löschen, gegebenenfalls schnell, Zweifelsfälle können durchaus erstmal in den BNR. --Gestumblindi 20:29, 7. Aug. 2026 (CEST)
- Das ist richtig, aber es ging ja um KI-Verdacht- und an anderer Stelle geht es um die Vorwürfe, dass nur behauptet werden muss, dass irgendwo genKI zum Einsatz kam, und schon wird gelöscht. Das Zwischenparken im BNR ist daher nicht immer die schlechteste Option, bis geklärt werden kann, ob der/die Autor*in willens und in der Lage ist, einen sorgfältig belegten Artikel zu schreiben. --Nina (Diskussion) 17:51, 7. Aug. 2026 (CEST)
