2026-07-25 · DATA ROOM

Vocalize AI

Vocalize AI: Tu agente de ventas IA 24/7 para citas calificadas.

shareX / TwitterLinkedInWhatsApp
Run Cost: $0.5600Market: El mercado global de automatización de ventas se valoró en ~$10 mil millones en 2023 y se espera que crezca significativamente. Vocalize AI se dirige al segmento de pymes (SMBs), que representa una parte sustancial de este mercado. El mercado objetivo inmediato (SAM) son las empresas en EE. UU. con equipos de ventas de 2 a 20 personas, un mercado valorado en más de $1.5 mil millones.
IP available for acquisition · Potential score 78/100ACQUIRE IP →

ELEVATOR PITCH

Vocalize AI es tu agente de IA que transforma llamadas de ventas repetitivas en citas calificadas para equipos de SDR y pymes. Con un excelente Health Score del 87% y un margen de beneficio del 84%, garantizamos una solución robusta y altamente rentable.

VALUE PROPOSITION

Nuestra propuesta de valor es la simplicidad: una experiencia de usuario intuitiva que permite a las pymes lanzar campañas de llamadas de IA y ver un ROI rápido sin complejidades empresariales.

EXPLAINER.md

ForgeEngineer·claude-opus-4-6
Full-Stack Code Generation

Vocalize AI — PollyReach MVP

Concepto

Agentes de voz con IA que ejecutan llamadas salientes repetitivas (cualificación de leads, concertación de citas, encuestas) de forma autónoma, liberando a equipos de ventas (SDRs), agencias inmobiliarias y pymes de servicios (clínicas, talleres) de la marcación manual. El equipo sube una lista de contactos (CSV), define el objetivo de la campaña, y el agente de IA llama, conversa, transcribe, clasifica el resultado y notifica cuando logra el objetivo (ej. "Cita agendada").

Arquitectura

Monolito modular Spring Boot 4.0.4 / Java 25, capas %%INLINE0%% → %%INLINE1%% → %%INLINE2%% → %%INLINE3%%, persistencia JPA (H2 embebido en memoria si no hay DATABASE_URL, Postgres en producción).

controller/   REST endpoints (dashboard + webhooks de telefonía)
service/      lógica de negocio (campañas, telefonía, IA conversacional, notificaciones)
repository/   Spring Data JPA
model/        entidades JPA (User, Campaign, Contact, CallLog) + enums
dto/          records inmutables (requests/responses)
security/     JWT stateless (io.jsonwebtoken)
client/       Feign hacia Twilio
config/       @ConfigurationProperties (jwt, twilio, notification), Jackson, Feign
exception/    ApiException + @RestControllerAdvice

Pipeline de llamada (%%INLINE5%% + %%INLINE6%%):

  1. CampaignService.launchCampaign despacha una llamada por contacto pendiente
en threads virtuales (Executors.newVirtualThreadPerTaskExecutor()), vía %%INLINE9%% → %%INLINE10%% (Feign). Sin credenciales reales de Twilio, degrada a modo simulado (SID local) para que el MVP corra sin cuenta externa.
  1. Al conectar, Twilio invoca POST /api/calls/webhook/voice → TwiML con saludo
inicial (simulación de TTS) y <Gather> de voz.
  1. Cada turno del contacto llega a POST /api/calls/webhook/speech (simulación de
STT) → ConversationAiService.nextAgentReply decide la respuesta (simulación de LLM, reglas por palabras clave) → nuevo TwiML.
  1. Al finalizar, POST /api/calls/webhook/status dispara clasificación
(%%INLINE16%%), resumen (%%INLINE17%%) y NotificationService (email simulado por log + webhook opcional si notification.webhook-url está configurado).

ConversationAiService es el punto de extensión para sustituir las reglas por llamadas reales a Whisper (STT) / GPT-4 (LLM) / ElevenLabs (TTS) sin tocar el resto del pipeline.

Endpoints

MétodoPathAuthDescripción
POST/api/auth/registerpúblicaAlta de usuario
POST/api/auth/loginpúblicaLogin, devuelve JWT
POST/api/campaignsJWTCrear campaña
GET/api/campaignsJWTListar campañas del usuario
GET/api/campaigns/{id}JWTDetalle + métricas
POST/api/campaigns/{id}/contactsJWTImportar contactos (multipart CSV)
GET/api/campaigns/{id}/contactsJWTListar contactos
POST/api/campaigns/{id}/launchJWTLanzar llamadas salientes
GET/api/campaigns/{id}/callsJWTTranscripciones, resúmenes y resultados
POST/api/calls/webhook/voicepública (Twilio)TwiML al conectar
POST/api/calls/webhook/speechpública (Twilio)TwiML por turno de voz
POST/api/calls/webhook/statuspública (Twilio)Cierre, resumen, notificación
CSV esperado: fullName,phoneNumber (con o sin encabezado).

Referencias

  • PollyReach — Product Hunt: https://www.producthunt.com/leaderboard/monthly/2026/5
  • Twilio Voice API (TwiML %%INLINE34%%/%%INLINE35%%): patrón de integración de telefonía.
  • Spring Boot 4.0.4 / Spring Framework 7 / Jackson 3 (tools.jackson.*).

Análisis de negocio

  • Problema: llamadas repetitivas de bajo valor (cualificación, citas) consumen
tiempo caro de personal humano, no escalan, generan agotamiento.
  • ROI medible: minutos de agente humano ahorrados por minuto de agente de IA;
tasa de citas agendadas por lead, directamente visible en CampaignResponse.
  • Monetización: SaaS por niveles — Básico (minutos + 1 agente), Profesional
(más minutos, multi-agente, CRM), Empresa (volumen + soporte). El modelo de datos (%%INLINE38%%, minutos vía %%INLINE39%%/endedAt) ya soporta medir consumo por plan.
  • Mercado: SDRs de startups, inmobiliarias, pymes de servicios — alto volumen
de llamadas repetitivas, acostumbrados a pagar por productividad.

Cómo ejecutar

cd solutions/2026-07-25-vocalize-ai-service
mvn spring-boot:run

Por defecto usa H2 en memoria (sin configurar spring.datasource.*). Ejemplo de flujo:

# 1. Registro
curl -X POST localhost:8080/api/auth/register \
  -H 'Content-Type: application/json' \
  -d '{"email":"sdr@pyme.com","password":"secreto123","fullName":"Ana SDR"}'

# 2. Crear campaña (usar el token devuelto)
curl -X POST localhost:8080/api/campaigns \
  -H "Authorization: Bearer <token>" -H 'Content-Type: application/json' \
  -d '{"name":"Q3 Leads","objective":"Agendar demo de producto","voiceProfile":"Polly.Lupe"}'

# 3. Importar contactos CSV
curl -X POST localhost:8080/api/campaigns/1/contacts \
  -H "Authorization: Bearer <token>" -F "file=@contactos.csv"

# 4. Lanzar campaña
curl -X POST localhost:8080/api/campaigns/1/launch -H "Authorization: Bearer <token>"

# 5. Ver resultados
curl localhost:8080/api/campaigns/1/calls -H "Authorization: Bearer <token>"

Config opcional vía variables de entorno / application.yml: twilio.account-sid, %%INLINE43%%, %%INLINE44%%, twilio.voice-webhook-base-url, %%INLINE46%%, %%INLINE47%%, jwt.expiration-ms.


Análisis FinOps para Vocalize AI

Introducción

Este análisis FinOps proporciona una estimación de los costos operativos y el margen de beneficio para 'Vocalize AI' en su fase inicial de MVP, asumiendo un modelo de negocio B2B SaaS. El objetivo es identificar los principales impulsores de costos y proponer estrategias de optimización para asegurar la viabilidad financiera.

Supuestos Clave

  • Volumen de Clientes: 20 clientes iniciales.
  • Modelo de Precios: Plan Básico de $25/mes por cliente.
  • Volumen de Llamadas: Cada cliente realiza 50 llamadas al mes, totalizando 1000 llamadas/mes.
  • Duración de Llamada: Promedio de 2 minutos por llamada.
  • Uso de IA por Llamada:
* LLM (gpt-4o-mini): Aproximadamente 2000 tokens por llamada (incluyendo prompts de sistema, transcripciones de usuario, respuestas de IA y procesamiento post-llamada). * STT (OpenAI Whisper): 2 minutos de audio por llamada. * TTS (AWS Polly): 1 minuto de audio generado por IA por llamada (equivalente a ~900 caracteres).
  • Infraestructura Cloud: Configuración básica en AWS para una aplicación Spring Boot (EC2, RDS).

Desglose de Costos Mensuales Estimados

CategoríaDescripciónCosto Mensual Estimado
LLM (OpenAI)gpt-4o-mini para 2M tokens/mes (entrada/salida)$1
Cloud HostingEC2 t3.small, RDS db.t3.micro, EBS, Networking$35
Telefonía (Twilio)2000 minutos salientes, 1 número de teléfono$27
STT (Whisper)2000 minutos de transcripción$12
TTS (AWS Polly)900,000 caracteres generados$5
Total de Costos$80

Ingresos Mensuales Estimados

  • Clientes: 20
  • Precio por Cliente: $25/mes (Plan Básico)
Ingreso Total: 20 $25 = $500/mes

Cálculo del Margen de Beneficio

  • Ingresos Mensuales: $500
  • Costos Mensuales: $80
  • Beneficio Bruto: $500 - $80 = $420
Margen de Beneficio: (($500 - $80) / $500) 100 = (420 / 500) * 100 = 84%

Recomendaciones FinOps para Optimización de Costos

  1. Optimización de LLM: Aunque gpt-4o-mini es extremadamente económico, la optimización de prompts para ser más concisos y el uso de técnicas de few-shot learning pueden reducir aún más el consumo de tokens. Considerar el caching de respuestas comunes para evitar llamadas repetitivas al LLM.
  2. Caché de STT/TTS: Para frases recurrentes (saludos, despedidas, confirmaciones), se puede pre-generar y almacenar el audio TTS. Esto reduce la dependencia de la API de TTS en tiempo real y sus costos.
  3. Gestión de la Duración de Llamadas: Diseñar los scripts de los agentes de IA para ser eficientes y directos, minimizando el tiempo de conversación improductivo. Cada segundo cuenta en los costos de telefonía y STT/TTS.
  4. Revisión de Proveedores de API: A medida que el volumen de llamadas crezca, explorar acuerdos de volumen con Twilio, OpenAI (para Whisper) y AWS (para Polly) o investigar proveedores alternativos que ofrezcan mejores tarifas para grandes volúmenes sin comprometer la calidad.
  5. Optimización de Infraestructura Cloud:
* Right-sizing: Asegurarse de que los recursos de EC2 y RDS estén dimensionados correctamente para la carga de trabajo actual, evitando el sobreaprovisionamiento. * Escalabilidad Elástica: Implementar auto-escalado para los componentes de procesamiento de llamadas para manejar picos de demanda eficientemente y reducir costos durante períodos de baja actividad. * Planes de Ahorro/Instancias Reservadas: Una vez que se tenga una carga base predecible, adquirir planes de ahorro o instancias reservadas en AWS para reducir los costos de EC2 y RDS a largo plazo.
  1. Monitoreo de Costos en Tiempo Real: Configurar alertas de presupuesto y paneles de control de costos en la nube para identificar rápidamente cualquier anomalía o aumento inesperado en el gasto.

Conclusión

'Vocalize AI' demuestra un modelo de negocio con un margen de beneficio saludable en su fase MVP, principalmente debido a la elección de modelos de IA de bajo costo (gpt-4o-mini, AWS Polly) y una infraestructura cloud básica. Los principales impulsores de costos son la telefonía y los servicios de STT. La implementación proactiva de estrategias FinOps, enfocadas en la optimización del uso de APIs y la gestión eficiente de la infraestructura, será crucial para mantener este margen a medida que la startup escale y adquiera más clientes.

MVP FEATURES

  • 01Dashboard de gestión de campañas para subir listas de contactos (CSV) y definir objetivos de llamada.
  • 02Agente de IA conversacional con voz personalizable para ejecutar las llamadas de forma autónoma.
  • 03Integración con un proveedor de telefonía para asignar un número y realizar llamadas salientes.
  • 04Generación automática de resúmenes de llamada, transcripciones y clasificación de resultados (ej. 'Cita agendada', 'No interesado', 'Llamar más tarde').
  • 05Notificaciones por email o webhook cuando se logre un objetivo clave (ej. cita agendada).

Transforma tus llamadas de ventas en citas calificadas con la IA que nunca descansa.

Revisad el código del MVP y preparémonos para la demo a clientes potenciales.

Related Startups