Agente de voz con IA en tiempo real
Sofia
Recepcionista telefónica 24/7 para clínicas: cascada voz→texto→LLM→voz con latencia mediana bajo 1.5s, tool-calling idempotente y conmutación de proveedor (Claude Haiku 4.5 / Gemini 2.5 Flash).
- Python 3.12
- LiveKit Agents
- Deepgram Nova-3
- Claude Haiku 4.5
- Gemini 2.5 Flash
- ElevenLabs Flash
- Silero VAD
- PostgreSQL
- Docker









network/
Terminé Intro to Deep Learning en Kaggle — mis primeras redes neuronales, montadas y entrenadas en Keras. Del ML clásico al deep learning.
Lancé el pipeline de voz en tiempo real de Sofia — Deepgram → Claude Haiku → ElevenLabs, ~1.4s de latencia mediana por turno.
Otro certificado de Kaggle Learn — ya van doce, y subiendo.
Volví a “ricear” Arch: Catppuccin Mocha por todos lados, Colemak-DH en teclado split.
Quedé 4º en Valencia y 11º en España en programación competitiva.
Llevé a Competitive Programming UPV de inactivo al equipo de CP más grande de España.