Skip to main content
Irth Solutions

Data Science ML/GenAI Engineer (FRE/ ENG) RD-014

RemoteCanada only· Prefers Canada
Published
Role
AI / ML
Experience
Mid
Employment
Full-time
CAD 80k–CAD 120k/yr
Check eligibility

Open to CA only · Prefers Canada. Set where you work from to check your eligibility.

The listing prefers candidates in Canada.

No BS summary

Ingénieur·e Data Science / ML/GenAI de niveau intermédiaire (3–5 ans), maîtrise de Python et Databricks, expérience pratique en NLP/LLM et productionisation de modèles. Poste télétravail au Canada (préférence pour le Québec). French spoken/written is an important asset; good English required.

Core skills

PythonDatabricksNLP/LLM

Required skills

pandasscikit-learnPyTorchREST APIsRetrieval-Augmented Generation (RAG)EmbeddingsSimilarity searchcosine similarityBM25Text deduplicationfuzzy matchingMinHashText classificationNamed Entity Recognition (NER)Prompt engineeringObject-oriented programmingAutomated testing

Optional skills

Vector databases / vector storesRAG frameworksFine-tuning NLP modelsMLflowTypeScriptNode.jsCI/CDGit

Required languages

English Fluent

Optional languages

French Fluent

What you'll do

  • Concevoir, prototyper et évaluer des solutions LLM/NLP afin de tester des hypothèses et de répondre à des besoins d’affaires et techniques.
  • Développer des solutions pour différents cas d’utilisation, notamment : classification de texte, extraction d’entités, recherche sémantique, résumé automatique et autres applications NLP/IA.
  • Expérimenter différentes approches, modèles et techniques afin d’identifier les solutions les plus pertinentes.
  • Évaluer la qualité, la performance et la pertinence des modèles avant leur passage en production.
  • Explorer, préparer, transformer et analyser les données de façon autonome avec Databricks.
  • Développer et améliorer les pipelines de données nécessaires aux modèles d’apprentissage automatique et aux solutions d’IA.
  • Préparer les données pour l’entraînement, l’évaluation et l’utilisation des modèles.
  • Identifier les enjeux liés à la qualité, à la structure et à la disponibilité des données et proposer des améliorations.
  • Transformer les prototypes et preuves de concept concluants en solutions prêtes pour la production.
  • Développer du code propre, modulaire, maintenable et bien testé.
  • Appliquer de bonnes pratiques de génie logiciel et de conception orientée objet.
  • Analyser le code existant, les pipelines de données et les applications afin de déterminer ce qui doit être préservé, amélioré, consolidé ou repensé.
  • Améliorer la fiabilité, l’évolutivité, les performances et la maintenabilité des solutions existantes.
  • Collaborer étroitement avec les équipes de data engineering, développement applicatif et ingénierie pour assurer une intégration efficace entre Databricks, pipelines, modèles et services applicatifs.
  • Participer aux décisions techniques et architecturales liées aux solutions de data science et d’IA.
  • Contribuer à l’établissement et à l’amélioration des pratiques de développement, de tests et de déploiement.
  • Collaborer avec les équipes techniques et les parties prenantes afin de traduire les besoins d’affaires en solutions concrètes.

What they require

  • 3 à 5 ans d’expérience en data science, en apprentissage automatique ou en ingénierie ML, avec une expérience démontrée dans le développement de code de qualité production, au-delà des environnements de notebooks.
  • Maîtrise ou expérience professionnelle équivalente en data science, en apprentissage automatique, en informatique, en statistiques ou dans un domaine connexe, avec de solides connaissances en statistiques et en méthodologies de modélisation.
  • Expérience pratique dans le développement de solutions NLP et/ou basées sur des LLM, notamment : Retrieval-Augmented Generation (RAG), embeddings et recherche par similarité (similarité cosinus), recherche hybride combinant BM25 et recherche sémantique, techniques de déduplication de texte (fuzzy matching, MinHash), classification de texte et reconnaissance d’entités nommées (NER), re-ranking, prompt engineering.
  • Excellente maîtrise de Python, incluant une expérience pratique avec pandas, scikit-learn, PyTorch et d’autres bibliothèques pertinentes d’apprentissage automatique.
  • Solide compréhension de la programmation orientée objet, du code propre et des principes de conception logicielle.
  • Solides compétences en analyse de données et expérience dans l’application de méthodes statistiques (analyse exploratoire, tests d’hypothèses, modélisation statistique).
  • Expérience pratique avec Databricks ou une plateforme de données/analytique comparable, incluant la capacité à explorer, transformer et préparer les données de façon autonome.
  • Bonne compréhension du cycle de vie complet de l’apprentissage automatique (entraînement, évaluation, déploiement, surveillance en production, dérive des modèles, qualité des données).
  • Expérience dans la conception et le développement d’API REST permettant d’exposer des données, des modèles ou des résultats analytiques aux applications en aval.
  • Capacité à comprendre et à améliorer du code et des pipelines existants et à transformer rapidement un prototype en solution robuste.
  • Esprit analytique, autonomie et capacité à résoudre des problèmes complexes.
  • Excellentes aptitudes à la collaboration avec des équipes multidisciplinaires.
  • Forte préférence pour les candidat(e)s résidant au Québec.

Benefits

  • Salaire compétitif — Une rémunération concurrentielle basée sur l'expérience et les qualifications.
  • Assurance médicale, dentaire et visuelle — Une couverture d'assurance complète pour vous et votre famille.
  • Régime de retraite avec contribution de l'employeur.
  • Congés payés généreux — Du temps libre pour favoriser l'équilibre travail-vie personnelle.
  • Jours fériés payés par l'entreprise — Congés payés tout au long de l'année.
  • Modalités de travail flexibles — Possibilité de télétravail selon le poste et les besoins de l'entreprise.
  • Compensation pour disponibilité — Rémunération additionnelle pour les quarts de garde admissibles.

Irth Solutions is a software product company building cutting-edge technology platforms that continuously set industry benchmarks. With a strong product culture, collaborative environment, and high growth potential, Irth offers an exciting opportunity to work on modern, enterprise-scale data platforms.

🇺🇸 United StatesSoftwareStartup

Details

Posting languageFrench
CAD 80k–CAD 120k/yr