Wie kann ich ein KI-Bild mit lokalem Bezug – z. B. in Augsburg – generieren, das auch realistisch aussieht?

Lass uns mal klären, was KI-Bildgeneratoren heute (noch) nicht gut können – bevor wir in die Details gehen.
Probleme bei realitätsnahen Stadtbildern:
- Lokale Besonderheiten wie Schilder, Straßennamen, Nummernschilder (Schriftzüge) sind unleserlich oder falsch geschrieben.
- KI versteht Begriffe wie „Maximilianstraße Augsburg“ oft nur vage – sie muss „raten“.
- Größe oder Anzahl von Gegenständen weichen von der gewünschten Vorgabe ab.
- KI priorisiert Bildelement in Vorder- bzw. Hintergrund unterschiedlich und lässt daher bei komplexen Prompts Dinge weg.
Beispiel: Hier wurde ein Auto mit deutschem Nummernschild angefordert – aber das Ergebnis passt nicht zur lokalen Namenskonvention (passend wäre A - EA 1899):

Vorschau: KI generiertes Bild - Kfz Nummernschild weicht von der im Prompt geforderten Stadt ab
Warum wir zur Problemlösung einen alternativen Ansatz brauchen
- Je nach KI-Modell und Version fehlten Gebäude, Brunnen oder Plätze in den Trainingsdaten oder wurden als lediglich als generisches Set an Bildern - ohne Zuordnung von Ort bzw. Namen der Sehenswürdigkeit - im Training verarbeitet.
- Sprachmodelle (LLMs) kennen weder Datum noch Uhrzeit.
- Sie können ohne zusätzliche Hilfsmittel keine mathematischen Rechenoperationen ausführen und schätzen daher das Ergebnis.
Okay, verstanden. Wie muss ich den Prompt denn schreiben, damit ich wirklich ein Bild aus Augsburg mit Herkulesbrunnen bekomme – und das Schild lesbar bleibt?

Gute Frage – mit ein paar Tricks kannst du deine Ergebnisse deutlich verbessern. Hier kommt eine kleine Prompt-Checkliste für lokale Bild-KI-Ergebnisse, z. B. für Augsburg:
1. Prominentes Motiv zuerst nennen
- „Herkulesbrunnen in Augsburg“ zuerst nennen – nicht das Auto. → So setzt die KI den Fokus richtig.
2. Deutsche Begriffe verwenden
- „Herkulesbrunnen“ statt „Hercules Fountain“ → Lokale Namen funktionieren besser als Übersetzungen.
3. Kontext sauber strukturieren
- Hintergrund & Vordergrund in eigenen Sätzen beschreiben: „Im Hintergrund der barocke Herkulesbrunnen mit Skulpturen. Im Vordergrund ein modernes E-Auto.“
4. Detailreich statt vage
- Beschreibe den Brunnen visuell: „Barocker Brunnen mit Steinfiguren, Schnee auf den Kanten, in einer Innenstadt mit Kopfsteinpflaster.“
5. Optional: Bildreferenz hochladen
- Falls möglich, verwende ein echtes Bild vom Ort als KI-Referenz.

Pro-Tipp: So findest du in 3 Schritten eine passende Bildreferenz z.B. über Wikipedia
6. Keep it simple
- Vermeide zu viele Anforderungen in einem Prompt. → Besser: Ort + 1 Objekt + 1 Stimmung (z. B. Schnee) statt alles auf einmal.
Ergebnis mit optimiertem Prompt (deutscher Name, klarer Kontext, weniger Wunschbilder):

Vorschau: KI generiertes Bild - Kfz Nummernschild weicht von der im Prompt geforderten Stadt ab
Fazit:
Mit einem klugen Prompt bekommst du deutlich realistischere Ergebnisse – sogar bei lokalen Orten wie Augsburg. Und wenn du einmal ein gutes Ergebnis hast: Speichere den Prompt und variiere nur kleine Details (z. B. Wetter oder Tageszeit).