Senior Software Engineer, Performance / Ingénieur(e) Logiciel(le) Senior, Performance
- Hybrid model (2–3 days in our Montréal office)
Tous ensemble, extraordinaires
Montréal, QC · Hybride
Aduna Global normalise et proxifie les APIs réseau CAMARA auprès de multiples CSPs à l’échelle mondiale. Pour nos clients enterprise, latence, débit et taux d’erreur ne sont pas des agréments — ils sont la proposition de valeur. Nous recrutons un(e) ingénieur(e) backend senior pour prendre en charge la performance en production: profiler des systèmes distribués, déployer des corrections et maintenir une plateforme multi-CSP rapide et prévisible au P99.
Ce que ce rôle est (et n’est pas)
Il s’agit d’un rôle d’ingénierie logicielle, non d’assurance qualité. Vous travaillerez directement dans le code de production : profiler et modifier des services backend, prendre en charge les corrections de bout en bout. Si vous avez déployé du code en production et êtes la personneappelée quand « tout semble normal, mais quelque chose ne va pas », lisez la suite.
Ce que vous ferez
- Profiler et analyser en profondeur les problèmes de performance en production à travers les services backend, les couches de passerelle API et les chemins d’intégration CSP, en utilisant des flame graphs, le tracing distribué, des outils basés sur eBPF et une instrumentation de bas niveau.
- Déployer des correctifs de performance dans le code de production : concurrence, gestion des connexions, mise en cache, contre-pression, et comportement des mécanismes de retry/timeout.
- Piloter l’optimisation de la latence de queue (P90/P99), notamment l’amplification de queue et la variabilité inter-CSP.
- Gérer les budgets d’erreur et les SLOs de performance, en partenariat avec la direction technique pour les défendre.
- Concevoir une infrastructure de benchmarking et d’injection de défaillances reflétant le trafic enterprise réel — aucune solution clé en main ne convient à une topologie multi-CSP.
- Intégrer la détection automatique de régression de performance dans le CI/CD.
- Concevoir l’instrumentation de télémétrie (New Relic ou équivalent), les tableaux de bord internes, la logique d’alerting et les heuristiques de détection d’anomalies.
- Modéliser et prévoir la capacité pour le trafic API multi-CSP, notamment le comportement en pic de charge et la variabilité régionale.
- Piloter les post-mortems pour produire des correctifs architecturaux durables, pas de simples chronologies.
Ce que vous apportez
- 5+ ans dans la création et l’exploitation de services backend en production en Go, Java, Python ou Node. Vous lirez, profilerez et corrigerez du code de production — pas seulement en rendrez compte.
- Solides fondamentaux en systèmes distribués : concurrence, contre-pression, stratégies de mise en cache et modes de défaillance.
- Compréhension approfondie des performances des APIs HTTP/REST : pooling de connexions, retries, timeouts et comportement de la latence inter-réseau.
- Expérience pratique du profiling : profileurs basés sur eBPF, analyse de flame graphs, profileurs CPU/mémoire.
- Expérience de l’observabilité en production (New Relic, Datadog ou similaire), y compris la conception de l’instrumentation — pas seulement la consultation de dashboards.
- [Ajoutez ici votre stack technique principale, ex. : Kubernetes, gRPC, Kafka, PostgreSQL, afin que les ingénieurs puissent s’auto-sélectionner.]
- Expérience avec des plateformes API à fort volume, des intégrations télécom ou des systèmes orientés CSP.
- Profil SRE : budgets d’erreur, chaos engineering, planification de capacité à grande échelle.
- Familiarité avec CAMARA ou d’autres standards ouverts d’APIs télécom.
Vous pourriez être le bon profil si…
- Vous ressentez une vraie excitation lorsqu’un flame graph révèle un mystère de 40 ms que vous n’attendiez pas.
- Vous avez été la personne appelée quand « tout semble normal, mais quelque chose ne va clairement pas ».
- Vous pensez en termes de latence de queue, et non de moyennes — et vous avez su (avec succès) expliquer pourquoi c’est important.
- Vous avez construit des outils de détection de régression de latence from scratch parce qu’aucune solution existante n’était suffisante.
- Vous avez proactivement traqué la dette de performance, bien avant que les clients ne la ressentent.
Pourquoi ce rôle compte
Aduna abstrait la complexité des télécoms mondiaux pour les développeurs enterprise via les standards CAMARA. La performance n’est pas une métrique ici — c’est le produit. Si vous voulez un travail visible, mesurable et fondamental, nous serions ravis de vous rencontrer.
- Construire une technologie qui impacte des millions de personnes
- Travailler avec des équipes passionnées et internationales
- Évoluer dans un environnement innovant et en croissance rapide
Notre offre:
- Modèle hybride (2-3 jours au bureau de Montréal)
- Salaire compétitif + avantages complets (dentaire, médical, REER/RPDB)
- Forte autonomie, collaboration et perspectives d’évolution
https://www.adunaglobal.com/privacy-notice/
Aduna s’engage en faveur d’un milieu de travail diversifié et inclusif.