2026-07-30 · DATA ROOM
AgentSphere
AgentSphere: Convierte tus chats de Meta en ventas 24/7
ELEVATOR PITCH
AgentSphere automatiza la gestión de consultas de WhatsApp e Instagram para PYMES, convirtiendo chats en ventas y soporte 24/7. Con un Health Score del 87% y un margen de beneficio del 91%, esta solución es robusta, escalable y financieramente viable.
VALUE PROPOSITION
Nuestra ventaja es un motor RAG 'AI-native' hiperespecializado en WhatsApp e Instagram, que permite a cualquier PYME crear agentes inteligentes sin código, con un ROI inmediato.
EXPLAINER.md
AgentSphere API
Concepto
AgentSphere resuelve la sobrecarga de mensajería de las pymes: agentes de IA "no-code" que atienden WhatsApp Business e Instagram Direct 24/7, califican leads y escalan a un humano cuando hace falta. Modelo SaaS por niveles según volumen de conversaciones y canales conectados.
Este repo es el MVP backend: Spring Boot 4.0.4 + Java 25.
Arquitectura
controller/ REST endpoints (auth, business, knowledge-base, webhooks, conversations)
service/ lógica de negocio (auth, business, RAG, IA, conversaciones, webhooks)
client/ clientes OpenFeign hacia OpenAI y la API Graph de Meta
security/ JWT (emisión/validación), filtro, UserDetailsService
repository/ Spring Data JPA sobre PostgreSQL
model/ entidades JPA + enums
dto/ records de entrada/salida por dominio (auth, business, knowledge, conversation)
config/ SecurityConfig, FeignConfig, *Properties (@ConfigurationProperties), JacksonConfig (pre-existente)
exception/ GlobalExceptionHandler + errores tipados
Capas separadas, inyección por constructor, DTOs como records, entidades JPA como clases mutables (JPA no soporta records como entidades gestionadas).
Motor RAG (simulado, sin dependencias externas)
KnowledgeBaseService trocea el texto ingerido (PDF/FAQ ya extraído a texto plano, o HTML de una URL vía RestClient), calcula un embedding ligero por hashing de términos (256 dims) y recupera los fragmentos más relevantes por similitud coseno. Sustituye a una base vectorial real (Pinecone/Weaviate) para el MVP; la interfaz (buildRelevantContext) es el punto de reemplazo cuando se integre una BD vectorial de verdad.
IA generativa
AiResponseService arma el prompt (contexto RAG + mensaje del cliente) y llama a %%INLINE4%% (Feign) contra %%INLINE5%%. Si openai.api-key no está configurada o la llamada falla, cae a una respuesta simulada basada en el contexto recuperado — el flujo completo funciona sin credenciales reales.
Canales de mensajería
MetaGraphClient (Feign) envía mensajes salientes a la API Graph de Meta (%%INLINE8%%) para WhatsApp e Instagram. %%INLINE9%% expone la verificación (%%INLINE10%%, handshake %%INLINE11%%) y la recepción (POST) de mensajes entrantes en tiempo real; WebhookService los parsea y ConversationService decide si responde la IA o si la conversación está pausada/escalada.
Endpoints
| Método | Ruta | Auth | Descripción |
|---|---|---|---|
| POST | /api/auth/register | pública | Alta de dueño de negocio + negocio inicial, devuelve JWT |
| POST | /api/auth/login | pública | Login, devuelve JWT |
| GET | /api/businesses/me | JWT | Datos del negocio autenticado |
| POST | /api/businesses/me/channels | JWT | Conecta WhatsApp o Instagram (tokens obtenidos vía OAuth de Meta) |
| POST | /api/knowledge-base/documents | JWT | Ingesta texto (PDF ya extraído / FAQ) para el agente |
| POST | /api/knowledge-base/url | JWT | Ingesta la web del negocio por URL |
| GET | /api/webhooks/meta | pública | Verificación del webhook (Meta) |
| POST | /api/webhooks/meta | pública | Recepción de mensajes entrantes (Meta) |
| GET | /api/conversations | JWT | Lista conversaciones del negocio |
| GET | /api/conversations/{id}/messages | JWT | Historial de una conversación |
| POST | /api/conversations/{id}/messages | JWT | Envío manual (pausa la IA, escala a humano) |
| POST | /api/conversations/{id}/resume-ai | JWT | Reactiva la IA en la conversación |
Referencias
technicalRequirementsdel BusinessCase: LLM (OpenAI vía Feign), RAG
implementationGuide: seguido paso a paso — setup, seguridad JWT,
Análisis de negocio
- Valor: automatiza el primer nivel de atención en los canales donde ya
- Diferenciación: especialización en mensajería directa (no un CRM
- Monetización: el modelo de datos ya separa negocio/canales/mensajes,
- Riesgo técnico cubierto en el MVP: si no hay credenciales de
Cómo ejecutar
# Requiere PostgreSQL accesible; configurar spring.datasource.* en
# application.yml o variables de entorno si no se usa el default embebido.
mvn clean compile
mvn spring-boot:run
Variables de entorno relevantes (todas opcionales, con defaults de desarrollo):
JWT_SECRET, JWT_EXPIRATION-MS
META_GRAPH-API-BASE-URL, META_WEBHOOK-VERIFY-TOKEN, META_APP-ID, META_APP-SECRET
OPENAI_BASE-URL, OPENAI_API-KEY, OPENAI_MODEL
Flujo de prueba end-to-end:
POST /api/auth/register→ obtener JWT.POST /api/knowledge-base/documentscon una FAQ → entrena al agente.- %%INLINE31%% con %%INLINE32%% → simula
POST /api/webhooks/metacon un payload de mensaje entrante → la IA
GET /api/conversations/{id}/messages).
POST /api/conversations/{id}/messages→ toma control manual.
FinOps Analysis para AgentSphere
Resumen de Costos y Rentabilidad
AgentSphere, en su fase de micro-startup con 20 clientes iniciales, demuestra una estructura de costos extremadamente eficiente y un margen de beneficio notablemente alto. Esto se debe principalmente a la elección estratégica de un modelo LLM de bajo costo (gpt-4o-mini) y una infraestructura cloud lean.
- Ingresos Mensuales Estimados: $750 (basado en 15 clientes Basic @ $25/mes y 5 clientes Standard @ $75/mes).
- Costos Operativos Mensuales Estimados: $70
- Margen de Beneficio: 91%
Desglose de Uso y Costos de LLM
La estimación de tokens se basa en un total de 4,000 conversaciones gestionadas al mes (promedio de 200 conversaciones por cliente), con cada conversación involucrando aproximadamente 3,300 tokens (entrada y salida combinados). Adicionalmente, se incluyen tokens para la actualización mensual de datos RAG y las consultas de embedding.
La elección de %%INLINE37%% es un factor clave en la contención de costos, ya que su precio por token es significativamente menor que el de modelos más grandes o incluso %%INLINE38%%, manteniendo un rendimiento adecuado para la mayoría de los casos de uso de mensajería.
Estrategia de Infraestructura Cloud
La infraestructura se ha diseñado para ser minimalista, utilizando servicios de AWS con instancias de bajo costo (%%INLINE39%% y %%INLINE40%%). Esto es apropiado para una micro-startup que busca validar su producto y optimizar el gasto inicial. La dependencia del tier gratuito de Pinecone para el vector store es una ventaja crucial en esta etapa.
Recomendaciones FinOps para Optimización de Costos
Para mantener este alto margen de beneficio y escalar de manera sostenible, AgentSphere debería considerar las siguientes optimizaciones FinOps:
- Caché de Respuestas LLM: Implementar una capa de caché robusta para las respuestas generadas por el LLM, especialmente para preguntas frecuentes o consultas idénticas. Esto reducirá drásticamente las llamadas redundantes a la API de OpenAI y, por ende, el consumo de tokens.
- Optimización de RAG y Prompt Engineering: Refinar continuamente las estrategias de chunking y recuperación de documentos para el RAG. Asegurarse de que solo el contexto más relevante y conciso se envíe al LLM para cada consulta, minimizando así el número de tokens de entrada. La optimización de los prompts también puede reducir el tamaño del input.
- Exploración de Serverless para Cargas Intermitentes: Para componentes específicos con cargas de trabajo intermitentes (ej. el endpoint de webhook de Meta para recibir mensajes o el servicio de ingesta de documentos), evaluar la migración a funciones serverless (como AWS Lambda). Esto permite pagar solo por la ejecución, lo que puede ser más rentable que mantener instancias siempre activas para tráfico variable.
- Gestión Inteligente de la Base de Datos Vectorial: Si el volumen de vectores supera el tier gratuito de Pinecone, antes de escalar a un plan de pago, considerar la implementación de
pgvectordirectamente en la base de datos PostgreSQL existente. Esto consolidaría los datos y evitaría un costo adicional de un servicio de vector database separado, aunque podría requerir ajustes en la gestión de la base de datos. - Monitoreo y 'Rightsizing' Continuo de Recursos Cloud: Utilizar herramientas de monitoreo (ej. AWS CloudWatch) para supervisar de cerca la utilización de CPU y RAM de las instancias EC2 y RDS. Si la utilización es consistentemente baja, considerar el 'downsizing' a instancias aún más pequeñas (ej. %%INLINE42%% o %%INLINE43%% para EC2) o explorar planes de ahorro como Reserved Instances (RI) o Savings Plans una vez que la carga de trabajo sea predecible y estable a largo plazo.
MVP FEATURES
- 01Integración segura con las APIs de WhatsApp Business e Instagram Direct.
- 02Constructor de agentes 'no-code': entrena un chatbot subiendo documentos (PDFs, FAQs) o introduciendo la URL de la web del negocio.
- 03Gestión automática de conversaciones: el agente responde preguntas frecuentes, califica leads y recopila información de contacto.
- 04Dashboard unificado: un panel simple para visualizar todas las conversaciones y tomar el control manual cuando la IA necesita escalar a un humano.
“Transforma tus chats de WhatsApp e Instagram en ventas y soporte ininterrumpido con AgentSphere.”
Revisen el MVP y prioricemos la completitud de las APIs CRUD y paginación para optimizar la UX.
LexiGuard AI
87LexiGuard AI revoluciona la creación de contenido para industrias reguladas, permitiendo a equipos de marketing y cumplimiento generar textos conformes al instante y con riesgo cero. Con un sólido Health Score del 87% y una UX del 91%, nuestra solución elimina errores costosos, acelera la agilidad del negocio y asegura auditorías impecables.
CompliWrite AI
86CompliWrite AI automatiza la creación de contenido y garantiza el cumplimiento normativo en tiempo real para equipos de marketing y cumplimiento en industrias reguladas como FinTech y Pharma. Con un Health Score del 87% y un margen de beneficio del 91%, la solución reduce drásticamente los ciclos de revisión legal y el riesgo de multas, mientras que su API ofrece una UX robusta (86%) y alta escalabilidad (95%).
CompliScan AI
85CompliScan AI automatiza el cumplimiento regulatorio para PYMES en salud y finanzas, eliminando miles de horas y riesgos con inteligencia artificial. Con un Health Score del 85% y un Profit Margin del 92%, transformamos esta obligación en una ventaja competitiva de alto valor.