Automatisierte Avatar-Video-Pipeline - KI-Video-Entwickler / KI-Video-Engineer

via Freelancer ·

Budget / SalaryHourly project
TypeFreelance project
LocationRemote
Posted13 hours ago
Ich möchte eine durchgehend automatisierte Pipeline aufsetzen, die jeden Tag kurze Video-Beiträge für News- und Wetterformate erzeugt – komplett mit fiktiven, digitalen Avataren, szenischen Bewegungen und perfekt passenden Lippenbewegungen zur TTS-Sprachausgabe.

Was mir dabei am wichtigsten ist:
• Audio-to-Video Lipsync hat höchste Priorität; die Lippen müssen exakt zum generierten Audio passen.
• Der Workflow soll in ComfyUI orchestriert werden, da ich dort bereits Modelle und Nodes verwalte.
• Absolute Charakter-Konsistenz über alle Clips hinweg ist Pflicht; Stil-Drift darf nicht vorkommen.

Kernaufgaben für dich:
1. Entwerfen und implementieren eines End-to-End-Workflows in ComfyUI, der
– Text-to-Video oder Image-to-Video Animationen für einfache Szenen startet,
– mithilfe von Stable Diffusion, Wan, Kling, LivePortrait (oder gleichwertigen Tools) die Bewegungen generiert,
– anschließend automatisiert Audio-to-Video Lipsync mit höchster Genauigkeit ausführt.
2. Anbindung an meine bestehenden TTS-Jobs via API, sodass jeden Morgen neue Sprachdateien abgeholt und in den Prozess gespeist werden.
3. Vollständige Automatisierung über n8n oder Make, inklusive Fehler-Handling und Slack-/Mail-Benachrichtigungen bei Abweichungen.
4. Dokumentation des Set-ups (Flow-Charts, Config-Files, Model-Versionen) und ein kurzes Video-Walkthrough, damit ich den Prozess später selbst anpassen kann.

Abnahme­kriterien:
• Ein Button- oder Cron-gesteuerter Durchlauf erzeugt innerhalb weniger Minuten ein fertiges 30-60-Sekunden-Video.
• Lippenbewegungen weichen maximal einen Frame von der Audio-Spur ab (visueller Test).
• Das End-MP4 ist ohne manuelle Nacharbeit sendefähig.

Wenn dir ComfyUI-Nodes, Stable Diffusion-Checkpoints und API-Automation im Schlaf gelingen, freue ich mich auf deinen Ansatz und eine kurze Referenz deiner bisherigen Pipeline-Projekte.
audio services voice talent german translator sound design local job ai (artificial intelligence) hw/sw stable diffusion ai development comfyui ai animation ai video ai voice agents ai automation ai video editing ai workflow automation
Apply on Freelancer →

Project sourced from Freelancer.com. Applications happen directly on the original platform — we never collect your data.