Sistema multi-agente que convierte una idea en un video de animación matemática, totalmente automatizado. Sin tocar código Manim ni la terminal.
Describes una idea → una cadena de agentes de IA produce el video completo:
Idea ──▶ Researcher ──▶ Planner ──▶ Beat Writer ──▶ Coder × escenas
│
(paralelo, hasta 4)
│
render -ql ──▶ Visual QA
│
Revisión humana
│
Editor (ffmpeg + -qh)
│
Curator (aprendizajes)
| Agente | Qué hace |
|---|---|
| Researcher | Busca plugins Manim necesarios para la idea |
| Planner | Genera el outline de escenas |
| Beat Writer | Sincroniza narración ↔ animación beat a beat |
| Coder | Escribe el código Manim de cada escena con audio embebido |
| Visual QA | Revisa frames del render y propone correcciones |
| Editor | Concatena escenas en el video final con ffmpeg |
| Curator | Extrae aprendizajes y mejora la skill de Manim |
No necesitas API key de Anthropic. Los agentes usan claude -p — tu propia suscripción Claude Code Pro.
- Backend — Python · FastAPI · WebSocket
- Agentes —
claude -pCLI (Claude Code) - Frontend — Next.js 15 · TypeScript · Tailwind · shadcn/ui
- Render — ManimCE · ffmpeg
- TTS — gTTS (gratis) · ElevenLabs (opcional)
- Claude Code con suscripción Pro y
claude authcompletado - Python ≥ 3.10
- Node.js ≥ 18
- ManimCE instalado (
manim --version) - ffmpeg instalado (
ffmpeg -version) - LaTeX instalado (MiKTeX / TeX Live)
Verifica el entorno:
python .agents/skills/manim/scripts/check_env.pygit clone https://github.com/HugoFernandezz/ManimEditorAgent.git
cd ManimEditorAgentcd backend
pip install -r requirements.txtCrea backend/.env (solo si usas ElevenLabs):
ELEVENLABS_API_KEY=tu_api_key
ELEVEN_API_KEY=tu_api_keycd ui
npm installCrea ui/.env.local (solo si quieres el botón "Exportar a Drive"):
NEXT_PUBLIC_GOOGLE_CLIENT_ID=<tu-client-id>.apps.googleusercontent.com→ Obtén uno gratis en Google Cloud Console · tipo Aplicación web · origin http://localhost:3000
# Windows — todo a la vez:
.\start.ps1
# O por separado:
# Terminal 1: cd backend && uvicorn main:app --reload
# Terminal 2: cd ui && npm run dev- Nuevo proyecto — barra lateral → "Nuevo proyecto" → nombre + descripción
- Configurar video — tab "Vista del flujo" → idea, idioma, formato (YouTube / TikTok), duración, voz, ciclos QA
- Lanzar — el pipeline corre en tiempo real, puedes ver cada agente en el tab "Ejecución"
- Aprobar plugins — el Researcher propone plugins; los instalas con un clic
- Revisar escenas — cada escena se muestra con preview + feedback antes del render final
- Video final — descarga el MP4 o expórtalo directo a Google Drive
| YouTube | TikTok | |
|---|---|---|
| Resolución | 1920 × 1080 (16:9) | 1080 × 1920 (9:16) |
| Narrativa | Analítica, progresiva | Hook primeros 3s, retención hiperactiva |
| Backend | Configuración | Coste |
|---|---|---|
| gTTS (default) | Sin config extra | Gratis |
| ElevenLabs | ELEVENLABS_API_KEY en backend/.env |
De pago |
ManimEditorAgent/
├── backend/ # FastAPI + agentes + harness
│ ├── agents/ # researcher, planner, beat_writer, coder, visual_qa, editor, curator
│ ├── harness/ # retry, graders, telemetría, debug logging
│ └── tools/ # ffmpeg, format context, voice context
├── ui/ # Next.js 15 — interfaz web
│ ├── app/ # rutas: proyecto, plugins, review, learnings
│ └── components/ # pipeline view, skill editor, export to drive…
├── .agents/skills/manim/ # skill viva: reglas, cheatsheet, troubleshooting
└── projects/ # generado en runtime (gitignoreado)
MIT