Wie kann ich ein KI-Bild mit lokalem Bezug – z. B. in Augsburg – generieren, das auch realistisch aussieht?

Jürgen B.
2025-06-21
Anna Hessler lächelt freundlich in einem Portraitfoto vor einer historischen Kulisse.

Lass uns mal klären, was KI-Bildgeneratoren heute (noch) nicht gut können – bevor wir in die Details gehen.

Probleme bei realitätsnahen Stadtbildern:

  1. Lokale Besonderheiten wie Schilder, Straßennamen, Nummernschilder (Schriftzüge) sind unleserlich oder falsch geschrieben.
  2. KI versteht Begriffe wie „Maximilianstraße Augsburg“ oft nur vage – sie muss „raten“.
  3. Größe oder Anzahl von Gegenständen weichen von der gewünschten Vorgabe ab.
  4. KI priorisiert Bildelement in Vorder- bzw. Hintergrund unterschiedlich und lässt daher bei komplexen Prompts Dinge weg.

Beispiel: Hier wurde ein Auto mit deutschem Nummernschild angefordert – aber das Ergebnis passt nicht zur lokalen Namenskonvention (passend wäre A - EA 1899):

KI Bilder mit lokalem Bezug - Auto von hinten mit KFZ Nummernschild

Vorschau: KI generiertes Bild - Kfz Nummernschild weicht von der im Prompt geforderten Stadt ab

Warum wir zur Problemlösung einen alternativen Ansatz brauchen

  • Je nach KI-Modell und Version fehlten Gebäude, Brunnen oder Plätze in den Trainingsdaten oder wurden als lediglich als generisches Set an Bildern - ohne Zuordnung von Ort bzw. Namen der Sehenswürdigkeit - im Training verarbeitet.
  • Sprachmodelle (LLMs) kennen weder Datum noch Uhrzeit.
  • Sie können ohne zusätzliche Hilfsmittel keine mathematischen Rechenoperationen ausführen und schätzen daher das Ergebnis.

Okay, verstanden. Wie muss ich den Prompt denn schreiben, damit ich wirklich ein Bild aus Augsburg mit Herkulesbrunnen bekomme – und das Schild lesbar bleibt?

Jürgen B.
2025-06-22
Anna Hessler lächelt freundlich in einem Portraitfoto vor einer historischen Kulisse.

Gute Frage – mit ein paar Tricks kannst du deine Ergebnisse deutlich verbessern. Hier kommt eine kleine Prompt-Checkliste für lokale Bild-KI-Ergebnisse, z. B. für Augsburg:

1. Prominentes Motiv zuerst nennen

  • „Herkulesbrunnen in Augsburg“ zuerst nennen – nicht das Auto. → So setzt die KI den Fokus richtig.

2. Deutsche Begriffe verwenden

  • „Herkulesbrunnen“ statt „Hercules Fountain“ → Lokale Namen funktionieren besser als Übersetzungen.

3. Kontext sauber strukturieren

  • Hintergrund & Vordergrund in eigenen Sätzen beschreiben: „Im Hintergrund der barocke Herkulesbrunnen mit Skulpturen. Im Vordergrund ein modernes E-Auto.“

4. Detailreich statt vage

  • Beschreibe den Brunnen visuell: „Barocker Brunnen mit Steinfiguren, Schnee auf den Kanten, in einer Innenstadt mit Kopfsteinpflaster.“

5. Optional: Bildreferenz hochladen

  • Falls möglich, verwende ein echtes Bild vom Ort als KI-Referenz.

KI Bilder mit lokalem Bezug - Auto vor dem Herkulesbrunnen

Pro-Tipp: So findest du in 3 Schritten eine passende Bildreferenz z.B. über Wikipedia

6. Keep it simple

  • Vermeide zu viele Anforderungen in einem Prompt. → Besser: Ort + 1 Objekt + 1 Stimmung (z. B. Schnee) statt alles auf einmal.

Ergebnis mit optimiertem Prompt (deutscher Name, klarer Kontext, weniger Wunschbilder):

KI Bilder mit lokalem Bezug - Auto vor dem Herkulesbrunnen

Vorschau: KI generiertes Bild - Kfz Nummernschild weicht von der im Prompt geforderten Stadt ab

Fazit:

Mit einem klugen Prompt bekommst du deutlich realistischere Ergebnisse – sogar bei lokalen Orten wie Augsburg. Und wenn du einmal ein gutes Ergebnis hast: Speichere den Prompt und variiere nur kleine Details (z. B. Wetter oder Tageszeit).

Schreibe einen Kommentar