BC Tecnología

Senior Data Scientist – GenAI & RAG (LATAM)

BC Tecnología · Remote
Tiempo completo 🤖 Machine Learning Hoy
Atención: eliminamos este aviso de nuestra base de datos al cabo de un mes (limpieza mensual), así que el enlace puede dejar de funcionar. Lo guardamos en tu navegador para que puedas volver a encontrarlo.

Competencias Críticas (Excluyentes)

Curado y limpieza de texto no estructurado proveniente de múltiples fuentes (chats, llamadas transcritas, registros CRM).
Diseño de curado y limpieza de texto no estructurado para preparación de contenido destinado a modelos de lenguaje.
Generación, gestión y versionado de embeddings.
Implementación y administración de bases de datos vectoriales (ej. pgvector, Qdrant, Chroma, Weaviate, Pinecone, Milvus) y búsqueda híbrida.
Construcción de pipelines RAG (Retrieval-Augmented Generation) completos, incluyendo evaluación y trazabilidad de respuestas.
Integración con APIs de modelos de lenguaje (LLM), tanto en servidores propios/internos como proveedores externos (Anthropic, OpenAI, Azure OpenAI, Google Gemini), con diseño agnóstico al proveedor.
Requisitos Técnicos
Programación y Datos
Python. SQL. PySpark. Apache Spark. Big Data. Desarrollo de procesos ETL/ELT. Manipulación y análisis de grandes volúmenes de datos.
Ciencia de Datos e IA
Análisis exploratorio de datos. Feature Engineering. Evaluación y optimización de modelos.
Herramientas y Framework
Bases de datos vectoriales (Pinecone, Weaviate, Chroma, Qdrant, Milvus o similares). Git.
Cloud
Azure. Servicios de almacenamiento y procesamiento de datos.

Principales Responsabilidades

Diseñar e implementar soluciones de Ciencia de Datos e Inteligencia Artificial.
Procesar, limpiar y transformar grandes volúmenes de datos provenientes de distintas fuentes.
Desarrollar pipelines de datos para la automatización de procesos analíticos.
Construir modelos predictivos, analíticos y de IA Generativa según las necesidades del negocio.
Implementar soluciones basadas en Large Language Models (LLMs).
Generar embeddings y trabajar con bases de datos vectoriales.
Participar en la definición de arquitecturas de datos y analítica avanzada.
Integrar distintas fuentes de información para generar modelos y automatizaciones.
Colaborar con equipos de negocio para identificar oportunidades de uso de datos e inteligencia artificial.
Documentar procesos, modelos y soluciones implementadas.

Conocimientos Deseables

(No excluyentes, ya que contamos con apoyo interno para esta parte)
Experiencia en Microsoft Fabric.
PythonSQLSpark
Fuente: GetOnBoard
Reportar oferta
📬 ¿Buscás trabajo remoto? Dejanos tu email y te avisamos cuando lancemos las alertas de ofertas.