2026-07-25 · DATA ROOM
Vocalize AI
Vocalize AI: Tu agente de ventas IA 24/7 para citas calificadas.
ELEVATOR PITCH
Vocalize AI es tu agente de IA que transforma llamadas de ventas repetitivas en citas calificadas para equipos de SDR y pymes. Con un excelente Health Score del 87% y un margen de beneficio del 84%, garantizamos una solución robusta y altamente rentable.
VALUE PROPOSITION
Nuestra propuesta de valor es la simplicidad: una experiencia de usuario intuitiva que permite a las pymes lanzar campañas de llamadas de IA y ver un ROI rápido sin complejidades empresariales.
EXPLAINER.md
Vocalize AI — PollyReach MVP
Concepto
Agentes de voz con IA que ejecutan llamadas salientes repetitivas (cualificación de leads, concertación de citas, encuestas) de forma autónoma, liberando a equipos de ventas (SDRs), agencias inmobiliarias y pymes de servicios (clínicas, talleres) de la marcación manual. El equipo sube una lista de contactos (CSV), define el objetivo de la campaña, y el agente de IA llama, conversa, transcribe, clasifica el resultado y notifica cuando logra el objetivo (ej. "Cita agendada").
Arquitectura
Monolito modular Spring Boot 4.0.4 / Java 25, capas %%INLINE0%% → %%INLINE1%% → %%INLINE2%% → %%INLINE3%%, persistencia JPA (H2 embebido en memoria si no hay DATABASE_URL, Postgres en producción).
controller/ REST endpoints (dashboard + webhooks de telefonía)
service/ lógica de negocio (campañas, telefonía, IA conversacional, notificaciones)
repository/ Spring Data JPA
model/ entidades JPA (User, Campaign, Contact, CallLog) + enums
dto/ records inmutables (requests/responses)
security/ JWT stateless (io.jsonwebtoken)
client/ Feign hacia Twilio
config/ @ConfigurationProperties (jwt, twilio, notification), Jackson, Feign
exception/ ApiException + @RestControllerAdvice
Pipeline de llamada (%%INLINE5%% + %%INLINE6%%):
CampaignService.launchCampaigndespacha una llamada por contacto pendiente
Executors.newVirtualThreadPerTaskExecutor()), vía %%INLINE9%% → %%INLINE10%% (Feign). Sin credenciales reales de Twilio, degrada a modo simulado (SID local) para que el MVP corra sin cuenta externa. - Al conectar, Twilio invoca
POST /api/calls/webhook/voice→ TwiML con saludo
<Gather> de voz. - Cada turno del contacto llega a
POST /api/calls/webhook/speech(simulación de
ConversationAiService.nextAgentReply decide la respuesta (simulación de LLM, reglas por palabras clave) → nuevo TwiML. - Al finalizar,
POST /api/calls/webhook/statusdispara clasificación
NotificationService (email simulado por log + webhook opcional si notification.webhook-url está configurado).
ConversationAiService es el punto de extensión para sustituir las reglas por llamadas reales a Whisper (STT) / GPT-4 (LLM) / ElevenLabs (TTS) sin tocar el resto del pipeline.
Endpoints
| Método | Path | Auth | Descripción |
|---|---|---|---|
| POST | /api/auth/register | pública | Alta de usuario |
| POST | /api/auth/login | pública | Login, devuelve JWT |
| POST | /api/campaigns | JWT | Crear campaña |
| GET | /api/campaigns | JWT | Listar campañas del usuario |
| GET | /api/campaigns/{id} | JWT | Detalle + métricas |
| POST | /api/campaigns/{id}/contacts | JWT | Importar contactos (multipart CSV) |
| GET | /api/campaigns/{id}/contacts | JWT | Listar contactos |
| POST | /api/campaigns/{id}/launch | JWT | Lanzar llamadas salientes |
| GET | /api/campaigns/{id}/calls | JWT | Transcripciones, resúmenes y resultados |
| POST | /api/calls/webhook/voice | pública (Twilio) | TwiML al conectar |
| POST | /api/calls/webhook/speech | pública (Twilio) | TwiML por turno de voz |
| POST | /api/calls/webhook/status | pública (Twilio) | Cierre, resumen, notificación |
fullName,phoneNumber (con o sin encabezado).
Referencias
- PollyReach — Product Hunt: https://www.producthunt.com/leaderboard/monthly/2026/5
- Twilio Voice API (TwiML %%INLINE34%%/%%INLINE35%%): patrón de integración de telefonía.
- Spring Boot 4.0.4 / Spring Framework 7 / Jackson 3 (
tools.jackson.*).
Análisis de negocio
- Problema: llamadas repetitivas de bajo valor (cualificación, citas) consumen
- ROI medible: minutos de agente humano ahorrados por minuto de agente de IA;
CampaignResponse.
- Monetización: SaaS por niveles — Básico (minutos + 1 agente), Profesional
endedAt) ya soporta medir
consumo por plan.
- Mercado: SDRs de startups, inmobiliarias, pymes de servicios — alto volumen
Cómo ejecutar
cd solutions/2026-07-25-vocalize-ai-service
mvn spring-boot:run
Por defecto usa H2 en memoria (sin configurar spring.datasource.*). Ejemplo de flujo:
# 1. Registro
curl -X POST localhost:8080/api/auth/register \
-H 'Content-Type: application/json' \
-d '{"email":"sdr@pyme.com","password":"secreto123","fullName":"Ana SDR"}'
# 2. Crear campaña (usar el token devuelto)
curl -X POST localhost:8080/api/campaigns \
-H "Authorization: Bearer <token>" -H 'Content-Type: application/json' \
-d '{"name":"Q3 Leads","objective":"Agendar demo de producto","voiceProfile":"Polly.Lupe"}'
# 3. Importar contactos CSV
curl -X POST localhost:8080/api/campaigns/1/contacts \
-H "Authorization: Bearer <token>" -F "file=@contactos.csv"
# 4. Lanzar campaña
curl -X POST localhost:8080/api/campaigns/1/launch -H "Authorization: Bearer <token>"
# 5. Ver resultados
curl localhost:8080/api/campaigns/1/calls -H "Authorization: Bearer <token>"
Config opcional vía variables de entorno / application.yml: twilio.account-sid, %%INLINE43%%, %%INLINE44%%, twilio.voice-webhook-base-url, %%INLINE46%%, %%INLINE47%%, jwt.expiration-ms.
Análisis FinOps para Vocalize AI
Introducción
Este análisis FinOps proporciona una estimación de los costos operativos y el margen de beneficio para 'Vocalize AI' en su fase inicial de MVP, asumiendo un modelo de negocio B2B SaaS. El objetivo es identificar los principales impulsores de costos y proponer estrategias de optimización para asegurar la viabilidad financiera.Supuestos Clave
- Volumen de Clientes: 20 clientes iniciales.
- Modelo de Precios: Plan Básico de $25/mes por cliente.
- Volumen de Llamadas: Cada cliente realiza 50 llamadas al mes, totalizando 1000 llamadas/mes.
- Duración de Llamada: Promedio de 2 minutos por llamada.
- Uso de IA por Llamada:
- Infraestructura Cloud: Configuración básica en AWS para una aplicación Spring Boot (EC2, RDS).
Desglose de Costos Mensuales Estimados
| Categoría | Descripción | Costo Mensual Estimado |
|---|---|---|
| LLM (OpenAI) | gpt-4o-mini para 2M tokens/mes (entrada/salida) | $1 |
| Cloud Hosting | EC2 t3.small, RDS db.t3.micro, EBS, Networking | $35 |
| Telefonía (Twilio) | 2000 minutos salientes, 1 número de teléfono | $27 |
| STT (Whisper) | 2000 minutos de transcripción | $12 |
| TTS (AWS Polly) | 900,000 caracteres generados | $5 |
| Total de Costos | $80 |
Ingresos Mensuales Estimados
- Clientes: 20
- Precio por Cliente: $25/mes (Plan Básico)
Cálculo del Margen de Beneficio
- Ingresos Mensuales: $500
- Costos Mensuales: $80
- Beneficio Bruto: $500 - $80 = $420
Recomendaciones FinOps para Optimización de Costos
- Optimización de LLM: Aunque
gpt-4o-minies extremadamente económico, la optimización de prompts para ser más concisos y el uso de técnicas de few-shot learning pueden reducir aún más el consumo de tokens. Considerar el caching de respuestas comunes para evitar llamadas repetitivas al LLM. - Caché de STT/TTS: Para frases recurrentes (saludos, despedidas, confirmaciones), se puede pre-generar y almacenar el audio TTS. Esto reduce la dependencia de la API de TTS en tiempo real y sus costos.
- Gestión de la Duración de Llamadas: Diseñar los scripts de los agentes de IA para ser eficientes y directos, minimizando el tiempo de conversación improductivo. Cada segundo cuenta en los costos de telefonía y STT/TTS.
- Revisión de Proveedores de API: A medida que el volumen de llamadas crezca, explorar acuerdos de volumen con Twilio, OpenAI (para Whisper) y AWS (para Polly) o investigar proveedores alternativos que ofrezcan mejores tarifas para grandes volúmenes sin comprometer la calidad.
- Optimización de Infraestructura Cloud:
- Monitoreo de Costos en Tiempo Real: Configurar alertas de presupuesto y paneles de control de costos en la nube para identificar rápidamente cualquier anomalía o aumento inesperado en el gasto.
Conclusión
'Vocalize AI' demuestra un modelo de negocio con un margen de beneficio saludable en su fase MVP, principalmente debido a la elección de modelos de IA de bajo costo (gpt-4o-mini, AWS Polly) y una infraestructura cloud básica. Los principales impulsores de costos son la telefonía y los servicios de STT. La implementación proactiva de estrategias FinOps, enfocadas en la optimización del uso de APIs y la gestión eficiente de la infraestructura, será crucial para mantener este margen a medida que la startup escale y adquiera más clientes.MVP FEATURES
- 01Dashboard de gestión de campañas para subir listas de contactos (CSV) y definir objetivos de llamada.
- 02Agente de IA conversacional con voz personalizable para ejecutar las llamadas de forma autónoma.
- 03Integración con un proveedor de telefonía para asignar un número y realizar llamadas salientes.
- 04Generación automática de resúmenes de llamada, transcripciones y clasificación de resultados (ej. 'Cita agendada', 'No interesado', 'Llamar más tarde').
- 05Notificaciones por email o webhook cuando se logre un objetivo clave (ej. cita agendada).
“Transforma tus llamadas de ventas en citas calificadas con la IA que nunca descansa.”
Revisad el código del MVP y preparémonos para la demo a clientes potenciales.
CertiCopy AI
90CertiCopy AI es la solución de IA que genera descripciones de producto atractivas y conformes para equipos de marketing en industrias reguladas. Resolvemos el costoso problema del incumplimiento normativo, acelerando lanzamientos y mitigando riesgos legales, con un robusto Health Score del 87% y un impresionante Profit Margin del 84%.
CertifyContent AI
88CertifyContent AI es un copiloto de IA que transforma la creación de descripciones de producto para industrias reguladas, garantizando cumplimiento y atractivo comercial. Con un Health Score del 87% y un Profit Margin del 89%, minimizamos riesgos legales y aceleramos el time-to-market para equipos de marketing y cumplimiento.
Redact AI
88Redact AI ofrece un microservicio API-first para que CTOs y Jefes de Ingeniería implementen el 'derecho al olvido' en sus modelos de IA, eliminando datos de usuario de forma segura. Con un Health Score del 84% y un margen de beneficio del 94%, garantizamos cumplimiento normativo, reducimos costes operativos y aceleramos la innovación sin reentrenamientos completos.