Científico de Datos Senior Senior Business Analyst - MD (Onsite 5 Days/Week)

Científico de Datos Senior

Tiempo completo • Senior Business Analyst - MD (Onsite 5 Days/Week)
Buscando un Científico de Datos Senior (NLP) para unirse a nuestro equipo en Woodlawn, MD, apoyando a una gran agencia federal. Este puesto requiere una amplia experiencia en Procesamiento del Lenguaje Natural (PLN) e IA Generativa. En este puesto, tenderás un puente entre la investigación algorítmica compleja y los sistemas de producción escalables. No solo construirás modelos de lenguaje sofisticados, sino que también actuarás como líder técnico, traduciendo datos complejos en decisiones estratégicas de negocio y colaborando estrechamente con equipos multifuncionales.

*Este es un puesto permanente que se espera que esté en las instalaciones 5 días a la semana.

Responsabilidades principales:
· Aplica conocimientos en Python, frameworks de NLP, SQL, Pandas, NLTK, SPACy y LLMs.
· Consulta y analiza datos transaccionales complejos usando SQL.
· Comprender los retos del mundo real y desarrollar soluciones automatizadas de datos.
· Desarrollar, probar y desplegar nuevas técnicas para la comprensión de la PLN.
· Desarrollo y despliegue escalable de enfoques de ML e IA generativa (como los Grandes Modelos de Lenguaje).
· Determinar la naturaleza de los problemas analíticos, evaluar opciones y ofrecer recomendaciones para su resolución.
· Asesora sobre los métodos y datos necesarios y/o disponibles para evaluar el problema (de inteligencia o de datos).
· Colaborar con recopiladores de datos y analistas para identificar y cerrar lagunas en problemas complejos de monitorización.
· Proporcionar análisis de datos precisos, oportunos, complejos y sofisticados.
· Entrenar y optimizar modelos de PLN/LLM y crear pipelines basados en Python.
· Crea soluciones nativas en la nube en AWS.

Requisitos mínimos:
· Se requiere la capacidad de obtener y mantener una autorización de Fideicomiso Público.
· Máster con 10+ años, grado 12+ años o 18+ años de experiencia relevante.
· Licenciatura en Estadística, Matemáticas Aplicadas, Informática o Ciencias de la Información y experiencia en la industria en Python, SQL, NLP (spaCy/NLTK) y LLM.
· Experiencia con IA Generativa y Grandes Modelos de Lenguaje (LLMs)
· Experiencia con despliegue y operaciones de modelos de ML como DevOps, MLOps, LLMOps.
· Experiencia en Procesamiento de Lenguaje Natural (PLN), Python, frameworks de PLN, SQL, Pandas, NLTK y SPACy.
· Domino la programación en Python, control de versiones y colaboración con GIT, paquetes estándar de Python (por ejemplo, Pandas, numpy, matplotlib) y frameworks de aprendizaje automático
· Conocimiento de TensorFlow, PyTorch, Pandas, scikit-learn, NLTK, Azure ML (opcional) y AWS EC2.
· Experiencia con frameworks de datos escalables (Apache Spark) y herramientas de orquestación de flujos de trabajo (Apache Airflow).
· Conocimiento experto en la realización de análisis de datos y en la aplicación de conceptos estadísticos avanzados y métodos de aprendizaje automático para construir, entrenar, probar y evaluar una variedad de modelos analíticos supervisados y no supervisados.
· Competente en extraer y manipular datos de diversas fuentes, incluyendo bases de datos SQL (DB2, Oracle, SQL Server), Hadoop y archivos planos.
· Experiencia con sistemas de gestión de bases de datos (por ejemplo, PostgresSQL, MySQL, SQLite, SQL, etc.).
· Experiencia con PLN y bibliotecas de IA generativa (por ejemplo, spaCy, LangChain), anotación de texto y marcos semánticos.
· Excelentes habilidades para resolver problemas, capacidad para colaborar con equipos multifuncionales y comunicación probada en formatos escritos y verbales para diversos públicos, incluyendo liderazgo ejecutivo.
· Excelentes habilidades analíticas para identificar riesgos potenciales y proponer soluciones eficaces.
· Capacidad para limpiar y procesar grandes cantidades de datos del mundo real.

Titulaciones deseadas:

· Se prefiere ampliamente la experiencia previa en la entrega de proyectos de TI en los sectores gubernamentales federales o estatales.
· Experiencia o disposición a aprender procesamiento distribuido a través del ecosistema Hadoop (Spark, Impala, Hive).
· Experiencia en procesamiento paralelo como programación por GPU con CUDA.
· Experiencia con procesamiento de lenguaje natural para detección de anomalías.
· Experiencia usando lenguajes de marcado como LaTeX, HTML, etc.
· Experiencia con Mathematica.
Compensación: 70,00 - 80,00 $ la hora




(si ya tienes un currículum en Indeed)

O aplicar aquí.

* campos requeridos

Text me updates about my application
Message and data rates may apply. Message frequency varies. Reply STOP to opt out. Reply HELP for help. See our User Terms of Service and Privacy Policy for details.
Ubicación
Or
Or
If no code provided, add their name instead.
Política de privacidad