jobszurich.ch
← Tutte le offerte

Site Reliability Engineer

DeepJudge

Tipo di contratto
Tempo pieno
Luogo
Zürich
Prima pubblicazione
Candidati ora
Chi siamo: DeepJudge è la principale scale-up svizzera in ambito AI e ICT, che sta trasformando il modo in cui gli studi legali e i dipartimenti legali accedono e sfruttano la propria conoscenza. Fondata da ex ingegneri di ricerca di Google con dottorati in AI presso l'ETH Zurich, e sostenuta da investitori di alto livello della Silicon Valley, stiamo costruendo lo strato di intelligenza che alimenta il settore legale. Ogni studio può licenziare gli stessi modelli di AI, ma non esistono due studi che condividano la stessa conoscenza istituzionale. Decenni di esperienza, prodotti di lavoro e precedenti sono spesso intrappolati in diversi sistemi, sottoutilizzati e inaccessibili. DeepJudge rende questa competenza istantaneamente disponibile attraverso una ricerca enterprise e un'infrastruttura AI di classe mondiale, consentendo agli studi di automatizzare i flussi di lavoro, costruire applicazioni basate sulla conoscenza e trasformare l'esperienza in un vantaggio duraturo. La nostra tecnologia è utilizzata da molti degli studi legali leader al mondo, tra cui Freshfields, Gunderson Dettmer, Holland & Knight, Arent Fox e Cozen O’Connor. Con sede in Svizzera e un team in crescita in Nord America, ci stiamo espandendo rapidamente e stiamo plasmando il futuro del modo in cui la conoscenza professionale viene scoperta e applicata. In DeepJudge, ci muoviamo velocemente, pensiamo rigorosamente e teniamo profondamente a ciò che costruiamo. Combiniamo la ricerca all'avanguardia con una stretta collaborazione con i nostri clienti per fornire soluzioni che abbiano un impatto reale. Se vuoi far parte di un team che definisce come l'AI trasforma il lavoro della conoscenza ad alto rischio, questo è il posto giusto. Informazioni sul ruolo: In qualità di Site Reliability Engineer presso DeepJudge, sarai responsabile dell'affidabilità dei sistemi di cui i principali studi legali dipendono ogni giorno. Gestiamo la nostra piattaforma di ricerca AI in ambienti di produzione dedicati, ognuno dei quali è un sistema di ricerca e recupero su larga scala che opera con volumi di dati molto elevati, insieme alle nostre pipeline di ingestione e ai data store, su un'infrastruttura orchestrata tramite container su più cloud pubblici e privati. Mantenere questi ambienti veloci, disponibili e affidabili è una vera sfida ingegneristica, ed è la tua missione. Questo è un ruolo tecnico focalizzato sull'infrastruttura: trascorrerai il tuo tempo tra sistemi, codice e telemetria. Rafforzerai la piattaforma in modo che le classi di guasti non possano ripetersi, costruirai osservabilità e SLO per permetterci di vedere i problemi prima che emergano, pianificherai la capacità in previsione della crescita incessante dei dati e automatizzerai il lavoro manuale (toil) per gestire in sicurezza molti ambienti di produzione. Lavorerai sulle nostre deployment e sull'infrastructure-as-code e collaborerai strettamente con l'ingegneria del prodotto per reinserire le lezioni apprese sull'affidabilità nella piattaforma. Se ti piace gestire sistemi distribuiti seri su larga scala e trasformare la gestione delle emergenze (firefighting) in affidabilità ingegnerizzata, questo ruolo è per te. Le tue responsabilità includeranno: - Gestire la disponibilità, la latenza e le prestazioni dei nostri ambienti di produzione: servizi di ricerca e recupero su larga scala, ingestione e data store su infrastruttura orchestrata tramite container su più cloud pubblici e privati - Gestire l'infrastruttura cloud su più cloud pubblici e privati, il networking, l'identità e l'accesso, il calcolo e lo storage, e gestire la capacità cloud, le quote e i costi man mano che la flotta cresce - Migliorare il deployment e l'infrastruttura tramite codice: configurazione e deployment basati su GitOps e infrastructure-as-code su tutti i nostri cloud pubblici e privati, con modifiche alla produzione sicure, preventivate e recuperabili - Definire e strumentare SLO e error budget e costruire le dashboard, le metriche e l'alerting che rendano la produzione osservabile e azionabile - Ridurre il lavoro manuale operativo attraverso l'automazione e strumenti interni scritti in Python e/o Go - Provisionare e standardizzare nuovi ambienti di produzione secondo un livello di affidabilità definito Sei il candidato ideale se: - Hai oltre 3 anni di esperienza in SRE, production / platform engineering o software engineering focalizzato sull'infrastruttura, gestendo sistemi di produzione reali sotto aspettative di affidabilità - Sei esperto nelle operazioni di orchestrazione di container in produzione e ti senti a tuo agio con almeno un importante cloud pubblico - Hai una solida esperienza di infrastruttura cloud su un importante cloud pubblico e una comprensione pratica di capacità cloud, quote e costi - Pratichi l'osservabilità in modo pratico con metriche, log e tracce, e la utilizzi per l'analisi delle cause radice (root-cause) di incidenti live - Lavori fluidamente con infrastructure-as-code e GitOps - Sai programmare in Python e/o Go per l'automazione, la creazione di strumenti e la lettura e correzione del codice dei servizi. - Possiedi un sano giudizio sulla produzione e documenti il tuo lavoro in modo chiaro per altri ingegneri - Bonus: esperienza nella gestione di un sistema di ricerca su larga scala o di dati distribuiti, operazioni di database, software dedicato/deployed in ambito enterprise, o infrastruttura AI / enterprise-search in domini regolamentati Cosa puoi aspettarti: - Gestire l'affidabilità di sistemi su cui si affidano i principali studi legali del mondo: scala reale, impatto reale - Lavoro profondo e pratico con infrastrutture moderne: ricerca distribuita su scala molto ampia, orchestrazione di container su più cloud e uno stack maturo di infrastructure-as-code e GitOps - Una cultura ingegneristica rigorosa e ad alta urgenza fondata da ex ingegneri di ricerca di Google e dottorati in AI dell'ETH Zurich - La possibi

Tradotto automaticamente dall’originale.

Pubblicato oggi

Luogo

Vedi su Google Maps