← KI-Avatar

KI-Avatar für Veranstaltungen

2.900 bis 5.500 € 14 bis 21 Tage

Auf Veranstaltungen ist ein KI-Avatar meist ein Stand für Gäste: Der Gast lässt sich fotografieren, nimmt eine kurze Stimmprobe auf und erhält nach etwa fünf Minuten ein Video im Hochformat, in dem sein digitaler Zwilling mit seiner eigenen Stimme spricht. So haben wir auf der KI-Konferenz von WMT AI gearbeitet: 100+ persönliche Avatare während der Veranstaltung, etwa fünf Minuten pro Person. Zwei weitere Formate: eine digitale Moderation auf dem Bildschirm, die Programmblöcke eröffnet und Speaker ankündigt, und der Avatar eines Speakers, der nicht anreisen kann. Im Folgenden: was wir vom Veranstalter brauchen, was es kostet und wo der Avatar vor Ort an Grenzen stößt.

100+
persönliche Avatare für Gäste der KI-Konferenz von WMT AI
5 Min.
pro Avatar, WMT AI

Bereits umgesetzt

Alle Referenzen
01

Drei Formate: Stand für Gäste, Moderation auf dem Bildschirm, abwesender Speaker

01.1

Avatar-Stand für Gäste

Er ist Attraktion und Content-Produktion zugleich: Der Gast lässt sich fotografieren, nimmt eine kurze Stimmprobe auf und erhält nach wenigen Minuten ein Video, in dem sein digitaler Zwilling einen kurzen, mit ihm abgestimmten Text über die Veranstaltung spricht. Der Veranstalter erhält eine Bibliothek persönlicher Videos der Teilnehmenden mit unterschriebenen Einwilligungen, der Gast einen Anlass, das Video in seinen eigenen Kanälen zu teilen.

01.2

Moderation auf dem Bildschirm

Der Avatar eröffnet die Veranstaltung, kündigt Programmblöcke an, liest Ablaufhinweise und Partnerblöcke vor. Es sind aufgezeichnete Videos nach abgestimmtem Skript: Sie werden vor der Veranstaltung produziert und von der Regie abgespielt. Vorteil: Der Text lässt sich noch einen Tag vor dem Start ändern, ohne neue Aufnahme. Nachteil: Der Avatar reagiert nicht auf das, was im Saal passiert, eine Moderation vor Ort brauchen Sie also trotzdem.

01.3

Speaker, der nicht anreisen kann

Die Person nimmt nach unserer Anleitung ein Video mit dem Smartphone und eine Sprachaufnahme auf, wir erstellen den Avatar und vertonen den Vortrag mit ihrer eigenen Stimme. Dieses Format setzen wir nur unter einer Bedingung ein: Das Publikum weiß, dass es ein generiertes Video sieht. Einen Avatar als Live-Schaltung auszugeben, lehnen wir ab.

02

So lief es auf der KI-Konferenz von WMT AI

Der Veranstalter wollte einen Ort auf der Konferenz, an dem Gäste stehen bleiben und mitmachen. Wir haben vor Ort eine Express-Pipeline aufgebaut: Foto des Gastes, Klonen der Stimme mit ElevenLabs in ein bis zwei Minuten, Generierung des KI-Avatars, fertiges Video im Hochformat mit einem Statement des Gastes für Reels und Shorts.

Während der Konferenz entstanden 100+ persönliche Avatare, etwa fünf Minuten pro Gast. Ein zusätzliches Ergebnis: WMT AI verfügt jetzt über eine Bibliothek persönlicher Videos der Teilnehmenden mit unterschriebenen Einwilligungen. In der Werbung werden sie mit dem Hinweis eingesetzt, dass das Video mit KI erstellt wurde.

Was funktioniert hat: ein kurzes Skript für ein Statement von 15 bis 20 Sekunden, eine ruhige Ecke für die Sprachaufnahme und ein vorab gedrucktes Einwilligungsformular. Was gestört hat: Lärm auf der Fläche während der Aufnahme und Gäste, die einen langen Text improvisieren wollten (darauf reagiert das Modell mit gleichförmiger, wenig lebendiger Sprechweise).

Wir kalkulieren das Format für Ihren Veranstaltungstermin

Moderation auf dem Bildschirm, ein Speaker, der nicht anreisen kann, oder ein Stand für Gäste: Wir nennen Preis und Dauer für Ihr Programm.

03

Was wir vom Veranstalter brauchen

03.1

Für die Moderation auf dem Bildschirm

Programm und Ablauf zwei Wochen vorher. Das Skript schreiben wir, angekündigt werden aber echte Personen und echte Programmblöcke, und ein kurzfristig verschobener Speaker bedeutet ein neues Video. Das Gesicht der Moderation: der Veranstalter, ein Partner, eine Person, die die Gäste kennen, oder ein Maskottchen, wenn kein echtes Gesicht nötig ist.

03.2

Für den Stand

Ein Platz mit gleichmäßigem Licht für Fotos, eine ruhige Ecke oder Kabine für die Sprachaufnahme, stabiles Internet, ein Bildschirm für die fertigen Videos und ein Tisch für das Einwilligungsformular. Stimme und Gesicht des Gastes sind personenbezogene Daten: Wir brauchen eine schriftliche Einwilligung in einem separaten Dokument. Die Formularvorlage stellen wir, der Gast unterschreibt vor der Aufnahme.

03.3

Für einen abwesenden Speaker

Ein Smartphone-Video und eine Sprachaufnahme nach unserer Anleitung sowie den Text des Vortrags, den der Speaker selbst freigegeben hat. Die Produktion dauert 14 Tage, wie bei einem regulären KI-Avatar.

04

Wo der Avatar auf Veranstaltungen an Grenzen stößt

04.1

Er führt keinen Live-Dialog

Fragen aus dem Publikum, Diskussionen, Reaktionen auf Verzögerungen oder Pannen übernimmt eine Moderation vor Ort. Im Paket erhalten Sie aufgezeichnete Videos; ein interaktives Format, das dem Publikum antwortet, setzen wir als Projekt ab 15.000 € um.

04.2

Lärm verträgt er schlecht

Eine Sprachaufnahme zwei Meter neben der Bühne ergibt ein Modell mit Artefakten. Ohne ruhige Zone funktioniert der Stand nicht, das sollten Sie im Flächenplan berücksichtigen.

04.3

Er ersetzt keine Eventdokumentation

Reportage, Interviews, Reaktionen des Publikums, Aufnahmen von Menschen: Dafür braucht es eine Kamera. Der Avatar liefert Videos mit sprechender Person und persönliche Videos der Gäste.

04.4

Wem er nichts bringt

Kleinen Veranstaltungen mit etwa zwanzig Personen (dort passt eine Moderation vor Ort besser und kostet weniger) und Veranstaltungen, bei denen nach dem Event kein Content gebraucht wird (der Stand rechnet sich gerade durch die Videos, die Gäste in ihren sozialen Netzwerken teilen).

05

Kosten und Vorlaufzeit

Den Preis für Veranstaltungen kalkulieren wir nach Format. Moderationsvideos und der Avatar eines abwesenden Speakers werden wie ein reguläres KI-Avatar-Paket berechnet: START mit Avatar, Stimmklon und 20 Videos für 2.900 €, PRO mit 30 Videos für 3.900 €, EXPERT mit 50 Videos für 5.500 €; Dauer 14 Tage, bei EXPERT 21 Tage. Für eine einzelne Veranstaltung reicht meist START: Eröffnung, Ablaufhinweise, Ankündigungen der Programmblöcke und Partnerblöcke passen in zwanzig kurze Videos. Alle Preise sind Nettopreise für Geschäftskunden.

Den Avatar-Stand für Gäste kalkulieren wir nach der Zahl der Gäste und den Betriebsstunden vor Ort: Davon hängt ab, wie viele Arbeitsplätze und Personen wir einsetzen. Den genauen Preis nennen wir nach dem Briefing, sobald wir Format und erwartete Teilnehmerzahl kennen.

Die Moderation sollten Sie mindestens drei Wochen vorher anfragen: zwei Wochen für Avatar und Videos, eine Woche für Programmänderungen, die es immer gibt. Den Stand einen Monat vorher, damit wir die Pipeline testen und das Einwilligungsformular mit der Rechtsabteilung des Veranstalters abstimmen können. Kontakt: Telegram @clyovo_ai, E-Mail german@clyovo.ru oder Telefon +7 919 997 99 62.

Pakete und Preise

START
2.900 €
20 Videos
  • 20 Videos im Reels-Format
  • KI-Avatar und Klon Ihrer Stimme
  • Skripte für jedes Video
  • Untertitel
Leistungsumfang im Detail
PROEmpfohlen
3.900 €
30 Videos
  • 30 Videos in beliebigem Format
  • KI-Avatar und Klon Ihrer Stimme
  • Skripte und Untertitel
  • A/B-Test der Vorschaubilder
Leistungsumfang im Detail
EXPERT
5.500 €
50 Videos
  • 50 Videos in mehreren Formaten
  • KI-Avatar, Stimmklon, Versionen im UGC-Stil
  • Kompletter Redaktionsplan
  • Vorschaubilder und Briefing für Social Ads
Leistungsumfang im Detail

Häufige Fragen

Die Fragen, die Kunden vor einer Anfrage stellen, und unsere Antworten.

Kann der Avatar live moderieren und dem Publikum antworten?

Der Avatar aus dem Paket antwortet nicht: Es sind aufgezeichnete Videos nach einem vorab geschriebenen Text. Er eröffnet die Veranstaltung, kündigt einen Programmblock an und liest einen Partnerblock vor, auf Fragen aus dem Publikum antwortet er nicht. Einen interaktiven Avatar, der dem Publikum antwortet, setzen wir als Projekt ab 15.000 € um.

Wie viele Gäste schafft der Stand?

Auf der KI-Konferenz von WMT AI brauchten wir etwa fünf Minuten pro Gast, insgesamt entstanden 100+ Avatare. Der Durchsatz hängt von der Zahl der Arbeitsplätze am Stand ab und davon, ob es eine ruhige Zone für die Aufnahme gibt: Ohne sie sinkt das Tempo, weil Aufnahmen wiederholt werden müssen.

Brauchen wir die Einwilligung der Gäste, und wer holt sie ein?

Ja, schriftlich und als separates Dokument: Stimme und Gesicht sind personenbezogene Daten. Die Formularvorlage stellen wir, Sie stimmen sie mit Ihrer Rechtsabteilung ab, der Gast unterschreibt vor der Aufnahme. Ohne Unterschrift des Gastes beginnen wir nicht.

Was erhält der Gast, und was bleibt dem Veranstalter?

Der Gast erhält ein Video im Hochformat für Reels und Shorts, in dem sein digitaler Zwilling mit seiner eigenen Stimme einen kurzen Text spricht: ein Statement zur Veranstaltung oder zu einem Partner oder die Antwort auf die Frage des Tages. Der Veranstalter erhält eine Bibliothek solcher Videos mit den Einwilligungen der Teilnehmenden, um die nächste Veranstaltung zu bewerben; bei Veröffentlichungen ist ein Hinweis nötig, dass das Video mit KI erstellt wurde.

Speaker aus einem anderen Land: Geht der Avatar auch in seiner Sprache?

Ja, die Vertonung ist in mehreren Sprachen möglich: Für FORCELAB haben wir eine mehrsprachige KI-Markenbotschafterin für verschiedene Märkte erstellt. Wichtig: Den Text in jeder Sprache sollte eine muttersprachliche Person freigeben. Abkürzungen und Namen schreiben wir so, wie sie klingen sollen, und hören jede Ersetzung ab.

Wessen Gesicht eignet sich für die Moderation auf dem Bildschirm?

Das Gesicht des Veranstalters oder einer Person, die die Gäste kennen. Wird kein echtes Gesicht gebraucht oder möchte die Person nicht vor die Kamera, nehmen wir ein Maskottchen: Für den internen KI-Kurs von SIBUR passte eine Figur anstelle einer Moderation besser. Einer gezeichneten Figur vertraut das Publikum weniger, deshalb ist für verkaufende Partnerblöcke ein echtes Gesicht die bessere Wahl.

Wie lange vorher sollten wir anfragen?

Die Moderation drei Wochen vorher: 14 Tage für Avatar und Videos plus Puffer für Programmänderungen. Den Stand einen Monat vorher: Wir testen die Pipeline vor Ort oder unter vergleichbaren Bedingungen und stimmen das Einwilligungsformular ab. Den Avatar eines abwesenden Speakers: 14 Tage ab Eingang seines Videos und seiner Sprachaufnahme.