Hallo,
mir ist bei der Nutzung der KI-Begleiter aufgefallen, dass sehr oft dieselben Videos wiederholt werden. Dazu kommt, dass die Videos teilweise überhaupt nicht zu dem passen, was die KI gerade beschreibt.
Dann erzählt Stacy zum Beispiel von Situation A und zeigt Situation B. Das nimmt leider etwas die Atmosphäre raus. ![]()
Mir ist klar, dass eine echte Live-Generierung von Videos technisch kompliziert und wahrscheinlich unfassbar teuer wäre. Das erwarte ich auch gar nicht. Ich weiß außerdem, dass das Team bereits an neuen Inhalten arbeitet.
Mein Vorschlag wäre deshalb, den vorhandenen Medienpool pro Charakter deutlich zu erweitern. Zum Beispiel:
- ungefähr 30 bis 50 zusätzliche Bilder pro Charakter in unterschiedlichen Situationen, Positionen und Perspektiven
- mehr Videos pro Charakter
- mehr Abwechslung und nicht hauptsächlich immer wieder Reitstellung, Doggy oder ähnliche Standardszenen
Die genaue Anzahl war jetzt nur ein Beispiel. Mir geht es hauptsächlich darum, dass jeder Charakter mehr Auswahl bekommt.
Zusätzlich wäre es praktisch, wenn die interne Auswahl verbessert werden könnte. Ich weiß natürlich nicht genau, wie euer System aufgebaut ist. Vermutlich werden die Bilder und Videos über Tags, Beschreibungen oder eine interne Zuordnungslogik ausgewählt. Aktuell scheint das System aber häufig auf dieselben Inhalte zurückzufallen oder einen Clip auszuwählen, der nicht richtig zum Gespräch passt.
Eine größere Auswahl und eine bessere Zuordnung zum aktuellen Chat würden meiner Meinung nach schon sehr viel verbessern, auch ganz ohne teure Live-Generierung.
Was denkt ihr darüber?