AI Trust Engineer Senior

Paradigma Digital S.L.

United States

Hybrid

USD 140,000 - 230,000

Full time

9 days ago
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Benefits offered by this job

Seguro médico y beneficios flexibles

Job summary

Paradigma Digital S.L. busca un/a AI Trust Engineer Senior para garantizar la calidad, fiabilidad y seguridad de sistemas de IA, LLMs y arquitecturas agénticas, cubriendo observabilidad, evaluación y gobernanza a lo largo del ciclo de vida desde diseño hasta producción.

El candidato ideal posee experiencia con Langfuse, Grafana, OpenTelemetry y herramientas de evaluación como RagA/DeepEval, y puede trabajar en remoto o híbrido, colaborando con equipos multi-disciplinares.

Qualifications

  • Experiencia práctica en IA generativa en producción.
  • Conocimiento de métricas y evaluación de LLMs.
  • Capacidad para definir métricas y gates automáticos.
  • Familiaridad con CI/CD e integración de evaluaciones.

Responsibilities

  • Diseñar y operar mecanismos de evaluación y gobernanza de IA.
  • Monitorear calidad, rendimiento, latencia y costes de LLMs y agentes.
  • Construir dashboards y alertas con Grafana.
  • Aplicar OpenTelemetry en sistemas de IA.
  • Desarrollar evaluaciones y benchmarks reproducibles.
  • Integrar quality gates en pipelines CI/CD.

Skills

AI Quality Engineering
Software Engineering
MLOps
Observability
IA/DS engineering
Python

Tools

Langfuse
Grafana
OpenTelemetry
Python

Job description

¡Forma parte del futuro de Paradigma!

En Paradigma sigue creciendo y buscamos un/a AI Trust Engineer Senior que nos ayude a garantizar la calidad, fiabilidad, trazabilidad y seguridad de nuestros sistemas de Inteligencia Artificial, LLMs y arquitecturas agénticas.

¿Que buscamos?

Importante: no buscamos un perfil de QA tradicional centrado en testing funcional. Buscamos un/a ingeniero/a capaz de entender cómo se comportan los modelos y agentes, medir objetivamente su calidad y construir los mecanismos que permitan evaluarlos y monitorizarlos de forma continua.

Responsabilidades

Tu misión será diseñar y operar los mecanismos de evaluación, observabilidad y gobierno de sistemas de IA, aportando evidencias objetivas de que su comportamiento cumple con los requisitos funcionales, técnicos y de negocio.

Trabajarás durante todo el ciclo de vida de las soluciones, desde el diseño hasta producción, colaborando estrechamente con equipos de Software Builders, Agentic Platform Engineers y AI Architects.

Entre tus principales responsabilidades estarán:

Observabilidad de LLMs y agentes

  • Instrumentar aplicaciones de IA utilizando Langfuse u otras herramientas equivalentes.
  • Capturar y analizar trazas completas: prompts, respuestas, llamadas a herramientas, pasos intermedios de agentes, latencia, tokens y costes.
  • Investigar comportamientos y detectar degradaciones o anomalías en producción.
  • Construir dashboards y alertas con Grafana para monitorizar calidad, rendimiento, latencia y costes.
  • Trabajar con estándares como OpenTelemetry aplicados a sistemas de IA.

Evaluación de LLMs

  • Diseñar y ejecutar evaluaciones utilizando frameworks como Ragas y DeepEval.
  • Trabajar con métricas de faithfulness, relevancia, precisión y exhaustividad del contexto en sistemas RAG, alucinaciones y uso correcto de herramientas.
  • Diseñar benchmarks y datasets de referencia para comparar versiones de forma reproducible.
  • Aplicar técnicas como Human-in-the-Loop y LLM-as-a-Judge, entendiendo sus limitaciones y posibles sesgos.
  • Evaluar la robustez y seguridad de sistemas de IA frente a sesgos, prompt injection y jailbreaks.
  • Definir métricas objetivas y criterios de aceptación adaptados a cada caso de uso.

Automatización y Quality Gates

  • Integrar evaluaciones de IA dentro de pipelines CI/CD.
  • Construir quality gates que permitan bloquear cambios que no cumplan los umbrales de calidad definidos.
  • Automatizar la evaluación de cambios en modelos, prompts, configuraciones y agentes.
  • Desarrollar herramientas y evaluaciones en Python, aplicando buenas prácticas de ingeniería de software.

Calidad y mejora continua

  • Construir y mantener un motor de evaluación basado en datasets versionados.
  • Detectar regresiones y comparar de forma reproducible el comportamiento entre versiones.
  • Garantizar la trazabilidad de las respuestas: contexto utilizado, modelo, versión del prompt y pasos intermedios del agente.
  • Definir y analizar KPIs de calidad e identificar oportunidades de mejora.
  • Comunicar el estado de la calidad de las soluciones tanto a perfiles técnicos como de negocio.
Debes tener experiencia en:

Buscamos una persona con +4 años de experiencia profesional en ámbitos como:

  • AI Quality Engineering
  • Software Engineering
  • MLOps
  • Observabilidad
  • Ingeniería de datos/IA

Y, especialmente, con experiencia práctica en IA generativa llevada a producción.

Nos interesa especialmente que tengas:

  • Experiencia real con Ragas y/o DeepEval.
  • Experiencia con Langfuse u otras plataformas de observabilidad de LLMs/agentes.
  • Experiencia integrando evaluaciones automatizadas como quality gates en CI/CD.
  • Conocimientos sólidos de Python.
  • Experiencia trabajando con LLMs, RAG y arquitecturas agénticas.
  • Conocimientos de métricas y metodologías de evaluación de LLMs.
  • Experiencia con Grafana y, valorable, OpenTelemetry.
  • Conocimientos sobre seguridad y robustez de sistemas de IA.
  • Capacidad para interpretar resultados y convertirlos en acciones de mejora.

Y sobre todo, buscamos a alguien que no se limite a ejecutar tests: queremos una persona capaz de definir qué significa que un sistema de IA sea bueno, cómo medirlo y cómo garantizarlo de forma automatizada y continua.

¿Por qué Paradigma?

Libertad con responsabilidad

Confiamos en las personas para organizar su trabajo de forma flexible, favoreciendo el equilibrio entre la vida personal y profesional sin perder de vista los objetivos y el impacto de nuestro trabajo. Tendrás la posibilidad de trabajar en un modelo de trabajo remoto o híbrido.

Una comunidad de referencia

Formarás parte de una comunidad ágil y tecnológica activa, donde compartir conocimiento, aprender de otros expertos y contribuir al desarrollo de las mejores prácticas del sector.

Acompañamiento desde el primer día

Contarás con el apoyo de un Buddy que te ayudará en tu integración, resolverá tus dudas y facilitará que te sientas parte de Paradigma desde el inicio.

Excelencia técnica como seña de identidad

Nos apasiona la tecnología y apostamos por el desarrollo continuo de nuestras capacidades. El conocimiento, la calidad y la mejora constante forman parte de nuestra cultura.

También apostamos por el aprendizaje continúo y tendrás acceso a un plan anual de formación, certificaciones oficiales y espacios de aprendizaje diseñados para impulsar tu desarrollo profesional.

Beneficios
  • seguro médico 100% subvencionado, retribución flexible a través de Edenred, 25 días de vacaciones anuales y otros beneficios orientados al bienestar de las personas.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Agentic AI Architect
Agentic AI Architect

Paradigma Digital S.L. • United States

Hybrid
USD 120,000 - 180,000
Seguro médico 100% subvencionado
Retribución flexible (Edenred)
25 días de vacaciones
AI Security & DevSecOps
AI Security & DevSecOps

Paradigma Digital S.L. • United States

Hybrid
USD 120,000 - 180,000
Seguro médico 100% subvencionado
Retribución flexible Edenred
25 días de vacaciones
Programador/a Python Senior
Programador/a Python Senior

Profile Software Services • United States

Remote
USD 101,000 - 168,000
Teletrabajo 100%
Jornada intensiva todos los viernes
Onboarding de calidad
+1
Senior AI Engineer
Senior AI Engineer

remoteo • United States

Remote
USD 140,000 - 200,000
Incorporación inmediata
Estabilidad laboral
Trabajo remoto 100% en España
+3
AI Engineer (AWS)
AI Engineer (AWS)

Logicalis Spain • United States

On-site
USD 101,000 - 157,000
Incorporación inmediata
Contrato indefinido
Trabajo 100% remoto (España)
+3
Sr IA Engineer
Sr IA Engineer

Coderio • United States

On-site
CLP 35,712,000 - 58,032,000
Remoto 100%
Rol estratégico
Equipo internacional
+1
AI Consultant
AI Consultant

IRIUM • United States

On-site
USD 30,000 - 49,000
Beneficios y formación continua
Cloud Engineer Mid/Sr
Cloud Engineer Mid/Sr

Alegra • United States

On-site
USD 120,000 - 170,000
100% remoto
Coworking mensual
Plan de desarrollo profesional
+1
AI Consultant
AI Consultant

IRIUM • United States

On-site
USD 45,000 - 55,000
Teletrabajo 100%
Formación continua
Beneficios
AI Architect (Latam)
AI Architect (Latam)

Knowmad Mood • United States

Remote
USD 120,000 - 180,000
Remote work
Flexible hours
International environment
+1