Senior Software Developer
Offre en anglaisThe role involves profiling and root-causing performance issues in production across backend services and API gateway layers. You will design benchmarking infrastructure, optimize tail latency, and ship performance fixes directly to the production codebase.
- Hybride
- Montréal, QC
- Publié 22 juill. 2026
- Postuler avant le 21 août 2026
- 1 poste
Résumé du poste
Senior Software Engineer, Performance / Ingénieur(e) Logiciel(le) Senior, Performance All Together, Extraordinary www.adunaglobal.com Montreal, QC · Hybrid Aduna Global normalizes and proxies CAMARA Network APIs across multiple global CSPs. For our enterprise customers, latency, throughput, and error rates are the value proposition. We are hiring a senior backend engineer to own performance as a production engineering discipline: profiling live systems, shipping fixes to production, and keeping a multi-CSP platform fast and predictable at P99. What This Role Is (and Is Not) This is a software engineering role, not a QA or test-automation position. You will work inside the production codebase: profiling, and modifying backend services, and owning performance fixes end to end. If you have shipped production code and been the engineer people call when “everything looks fine, but something is clearly wrong,” read on. What You’ll Do Profile and root-cause performance issues in production across backend services, API gateway layers, and CSP integration paths, using flame graphs, distributed tracing, eBPF-based tooling, and low-level instrumentation. Ship performance fixes to production code: concurrency, connection management, caching, backpressure, and retry/timeout behavior. Drive tail-latency (P90/P99) optimization, including tail amplification and cross-CSP variability. Own error budgets and performance SLOs, partnering with engineering leadership to defend them. Design and build load-generation, benchmarking, and failure-injection infrastructure reflecting real enterprise traffic — nothing off-the-shelf fits a multi-CSP topology. Integrate automated performance-regression detection into CI/CD. Design telemetry instrumentation (New Relic or equivalent), internal dashboards, alerting logic, and anomaly-detection heuristics. Model and forecast capacity for multi-CSP API traffic, including peak-load behavior and regional variability. Lead post-incident reviews that produce architectural fixes, not just timelines. What You Bring 5+ years building and operating production backend services in Go, Java, Python, or Node. You will read, profile, and fix production code, not report on it. Strong distributed-systems fundamentals: concurrency, backpressure, caching strategies, and failure modes. Deep understanding of HTTP/REST API performance: connection pooling, retries, timeouts, and cross-network latency behavior. Hands-on profiling experience: eBPF-based profilers, flame graph analysis, CPU/memory profilers. Production observability experience (New Relic, Datadog, or similar), including designing instrumentation — not just consuming dashboards. ✨ Bonus Experience with high-volume API platforms, telecom integrations, or CSP-facing systems. SRE background: error budgets, chaos engineering, capacity planning at scale. Familiarity with CAMARA or other open telecom API standards. You Might Be a Fit If… You get genuinely excited when a flame graph reveals a 40ms mystery you didn’t expect. You’ve been the person who gets called when “everything looks fine, but something is clearly wrong.” You think in terms of tail latency, not averages, and you’ve argued (successfully) why that matters. You’ve built latency-regression tooling from scratch because nothing off-the-shelf was good enough. You’ve hunted down performance debt proactively, long before customers felt the pain. Why This Role Matters Aduna abstracts global telecom complexity for enterprise developers via open CAMARA standards, delivering predictable, low-latency APIs. Performance isn’t a metric here; it is the product. If you want to own performance at a company where your work is visible, measurable, and foundational, we’d like to meet you. 🌟 Why Join Aduna? Build technology that impacts millions Work with passionate, global teams Growth in a fast-moving, innovative environment Our Offer: Hybrid model (2–3 days in our Montréal office) Competitive salary + full benefits (dental, medical, RRSP/DPSP) Unlimited PTO High ownership, collaboration, and room to grow 📄 By applying, you consent to the processing of your personal data for recruitment purposes. 🔗 Privacy notice: https://www.adunaglobal.com/privacy-notice/ Aduna is committed to a diverse and inclusive workplace. Tous ensemble, extraordinaires Montréal, QC · Hybride Aduna Global normalise et proxifie les APIs réseau CAMARA auprès de multiples CSPs à l’échelle mondiale. Pour nos clients enterprise, latence, débit et taux d’erreur ne sont pas des agréments — ils sont la proposition de valeur. Nous recrutons un(e) ingénieur(e) backend senior pour prendre en charge la performance en production: profiler des systèmes distribués, déployer des corrections et maintenir une plateforme multi-CSP rapide et prévisible au P99. Ce que ce rôle est (et n’est pas) Il s’agit d’un rôle d’ingénierie logicielle, non d’assurance qualité. Vous travaillerez directement dans le code de production : profiler et modifier des services backend, prendre en charge les corrections de bout en bout. Si vous avez déployé du code en production et êtes la personneappelée quand « tout semble normal, mais quelque chose ne va pas », lisez la suite. Ce que vous ferez Profiler et analyser en profondeur les problèmes de performance en production à travers les services backend, les couches de passerelle API et les chemins d’intégration CSP, en utilisant des flame graphs, le tracing distribué, des outils basés sur eBPF et une instrumentation de bas niveau. Déployer des correctifs de performance dans le code de production : concurrence, gestion des connexions, mise en cache, contre-pression, et comportement des mécanismes de retry/timeout. Piloter l’optimisation de la latence de queue (P90/P99), notamment l’amplification de queue et la variabilité inter-CSP. Gérer les budgets d’erreur et les SLOs de performance, en partenariat avec la direction technique pour les défendre. Concevoir une infrastructure de benchmarking et d’injection de défaillances reflétant le trafic enterprise réel — aucune solution clé en main ne convient à une topologie multi-CSP. Intégrer la détection automatique de régression de performance dans le CI/CD. Concevoir l’instrumentation de télémétrie (New Relic ou équivalent), les tableaux de bord internes, la logique d’alerting et les heuristiques de détection d’anomalies. Modéliser et prévoir la capacité pour le trafic API multi-CSP, notamment le comportement en pic de charge et la variabilité régionale. Piloter les post-mortems pour produire des correctifs architecturaux durables, pas de simples chronologies. Ce que vous apportez 5+ ans dans la création et l’exploitation de services backend en production en Go, Java, Python ou Node. Vous lirez, profilerez et corrigerez du code de production — pas seulement en rendrez compte. Solides fondamentaux en systèmes distribués : concurrence, contre-pression, stratégies de mise en cache et modes de défaillance. Compréhension approfondie des performances des APIs HTTP/REST : pooling de connexions, retries, timeouts et comportement de la latence inter-réseau. Expérience pratique du profiling : profileurs basés sur eBPF, analyse de flame graphs, profileurs CPU/mémoire. Expérience de l’observabilité en production (New Relic, Datadog ou similaire), y compris la conception de l’instrumentation — pas seulement la consultation de dashboards. [Ajoutez ici votre stack technique principale, ex. : Kubernetes, gRPC, Kafka, PostgreSQL, afin que les ingénieurs puissent s’auto-sélectionner.] ✨ Bonus Expérience avec des plateformes API à fort volume, des intégrations télécom ou des systèmes orientés CSP. Profil SRE : budgets d’erreur, chaos engineering, planification de capacité à grande échelle. Familiarité avec CAMARA ou d’autres standards ouverts d’APIs télécom. Vous pourriez être le bon profil si… Vous ressentez une vraie excitation lorsqu’un flame graph révèle un mystère de 40 ms que vous n’attendiez pas. Vous avez été la personne appelée quand « tout semble normal, mais quelque chose ne va clairement pas ». Vous pensez en termes de latence de queue, et non de moyennes — et vous avez su (avec succès) expliquer pourquoi c’est important. Vous avez construit des outils de détection de régression de latence from scratch parce qu’aucune solution existante n’était suffisante. Vous avez proactivement traqué la dette de performance, bien avant que les clients ne la ressentent. Pourquoi ce rôle compte Aduna abstrait la complexité des télécoms mondiaux pour les développeurs enterprise via les standards CAMARA. La performance n’est pas une métrique ici — c’est le produit. Si vous voulez un travail visible, mesurable et fondamental, nous serions ravis de vous rencontrer. 🌟 Pourquoi rejoindre Aduna? Construire une technologie qui impacte des millions de personnes Travailler avec des équipes passionnées et internationales Évoluer dans un environnement innovant et en croissance rapide Notre offre: Modèle hybride (2-3 jours au bureau de Montréal) Salaire compétitif + avantages complets (dentaire, médical, REER/RPDB) Congés illimités Forte autonomie, collaboration et perspectives d’évolution 📄 En postulant, vous consentez au traitement de vos données personnelles à des fins de recrutement. 🔗 Avis de confidentialité : https://www.adunaglobal.com/privacy-notice/ Aduna s’engage en faveur d’un milieu de travail diversifié et inclusif.
Ce que vous ferez
The role involves profiling and root-causing performance issues in production across backend services and API gateway layers. You will design benchmarking infrastructure, optimize tail latency, and ship performance fixes directly to the production codebase.
Exigences
Candidates must have over 5 years of experience building production backend services in Go, Java, Python, or Node. Deep expertise in distributed systems, HTTP/REST performance, and hands-on profiling with tools like eBPF is required.
Avantages
• Dental • Medical • RRSP/DPSP • Unlimited PTO
Autres compétences pertinentes
Relevées dans la description du poste. Confirmez les exigences importantes ci-dessus.
- Go
- Java
- Python
- Node
- Distributed Systems
- eBPF
- Flame Graphs
- HTTP/REST API
- Observability
- New Relic
- Datadog
- Concurrency
- Performance Profiling
- CI/CD
- Chaos Engineering
- Capacity Planning
Domaines d’emploi
- Software
- Engineering
- Technology
Renseignements supplémentaires
- Expérience minimale
- 5+ ans
- Postuler avant le
- 21 août 2026
- Langue de l’offre
- anglais
- Heures de travail
- 40 heures par semaine
- Présence au bureau
- 3 jours par semaine
- Niveau d’expérience
- Mid-Senior level
- Mode de candidature
- La candidature directe est offerte