Desarrollador(a) de IA Generativa / LLM Engineer (On-Premise) Semi Sr
Puebla | Presencial | Tiempo completo
Buscamos un(a) LLM Engineer para desarrollar un asistente conversacional completamente on-premise, donde ningún dato abandona la infraestructura del cliente.
Experiencia :3 años
Responsabilidades
- Desplegar y operar motores de inferencia locales utilizando modelos open-weight cuantizados (vLLM, Ollama, llama.cpp, TGI o similares).
- Construir agentes conversacionales en español con memoria de sesión y herramientas controladas mediante SQL parametrizado.
- Implementar controles de acceso por rol y ubicación directamente en la lógica de negocio.
- Desarrollar servicios de detección de patrones de riesgo sobre texto con niveles de confianza y trazabilidad.
- Implementar pipelines locales de voz (STT, traducción bidireccional y TTS) para español ↔ lengua originaria.
- Desarrollar pipelines OCR para identificaciones oficiales con validación y métricas de confianza.
- Exponer los componentes mediante microservicios en FastAPI con logs estructurados y trazabilidad de inferencias.
- Colaborar con equipos de Backend y especialistas en entrenamiento de modelos.
Requisitos
- Ingeniería en Sistemas, Computación, Ciencia de Datos o carrera afín.
- Mínimo 2 años de experiencia desarrollando con Python en producción.
- Experiencia con FastAPI o framework similar.
- Haber desplegado modelos open-weight localmente utilizando herramientas como:
- vLLM
- Ollama
- llama.cpp
- TGI
- Experiencia construyendo agentes de IA mediante:
- LangChain
- LlamaIndex
- Function Calling
- RAG en producción
- Capacidad para medir y evaluar sistemas de IA mediante métricas y experimentación.
- Manejo de Git, Docker y servidores Linux.
- Alto compromiso con la confidencialidad y el manejo seguro de la información.
Modalidad: Presencial en Puebla.
Sueldo: $30,000.00 - $35,000.00 al mes
Lugar de trabajo: Empleo presencial