Senior Solutions Architetto – Large Scale Neural Networks Inference — NVIDIA (ufficio Zurich)

NuovoCHF 113'500 - 172'000
NVIDIA (ufficio Zurich) · Zürich (ZH)
Categoria: Ingegneria Contratto: full-time Salario: CHF 113'500 - 172'000
Vai alla candidatura
Località
Zürich
Contratto
full-time
Pubblicato
3 giorni fa
SalarioCHF 113'500 - 172'000

Panoramica

Siamo alla ricerca di un Senior Solutions Architect con profonda esperienza nell'inferenza di rete neurale su larga scala e una comprovata capacità di condurre la collaborazione tecnica con i laboratori AI di frontiera e le imprese che dispiegano l'IA su scala in EMEA. In questo ruolo, si definisce la direzione tecnica per l'inferenza AI attraverso EMEA identificando i colli di bottiglia critici e guidando lo sviluppo di soluzioni scalabili e ad alto impatto. Allineando i membri del team chiave all'interno di NVIDIA e organizzazioni dei clienti, influenzerai le decisioni strategiche sulla tecnologia per sviluppare l'implementazione dell'inferenza AI di nuova generazione in scala.

  • Guida la strategia di inferenza per un portafoglio di clienti EMEA AI Natives, guidando gli impegni dalla prova iniziale del concetto alle implementazioni su scala di produzione.
  • Identificare le sfide di inferenza attraverso le implementazioni dei clienti tra cui latenza, l'efficienza, il costo per token, l'utilizzo della memoria e la rete a bassa latenza.
  • Architetto e ottimizza le condotte di inferenza ad alte prestazioni utilizzando i backend NVIDIA Dynamo, TensorRT-LLM, vLLM, SGLang e altri backend di inferenza, migliorando l'utilizzo della GPU e l'efficienza del cluster AI.
  • Traduci le intuizioni dei clienti e i modelli di distribuzione in feedback dei prodotti attuabili che sviluppa la roadmap per lo stack NVIDIA come Dynamo, TensorRT-LLM e NIM.
  • MS o PhD in Informatica, Ingegneria, o esperienza equivalente nel campo.
  • 8+ anni nell'infrastruttura AI/ML, con profonda esperienza nell'ottimizzazione dell'inferenza LLM/VLM e nella distribuzione della produzione su scala.
  • Profonda comprensione dell'accelerazione dell'inferenza del trasformatore: quantizzazione (INT4/FP8), decodifica speculativa, inferenza disaggregata, batch continuo, ottimizzazione della cache KV e WideEP per modelli MoE.
  • Comprendere le gerarchie di memoria GPU e la rete a bassa latenza con la loro influenza sulle prestazioni di inferenza.
  • Provato record di pista per condurre iniziative tecniche.

Requisiti principali

  • Siamo alla ricerca di un Senior Solutions Architect con profonda esperienza nell'inferenza di rete neurale su larga scala e una comprovata capacità di condurre la collaborazione tecnica con i laboratori AI di frontiera e le imprese che dispiegano l'IA su scala in EMEA.
  • In questo ruolo, si definisce la direzione tecnica per l'inferenza AI attraverso EMEA identificando i colli di bottiglia critici e guidando lo sviluppo di soluzioni scalabili e ad alto impatto.
  • Allineando i membri del team chiave all'interno di NVIDIA e organizzazioni dei clienti, influenzerai le decisioni strategiche sulla tecnologia per sviluppare l'implementazione dell'inferenza AI di nuova generazione in scala. Cosa farai:
  • Guida la strategia di inferenza per un portafoglio di clienti EMEA AI Natives, guidando gli impegni dalla prova iniziale del concetto alle implementazioni su scala di produzione.
  • Identificare le sfide di inferenza attraverso le implementazioni dei clienti tra cui latenza, l'efficienza, il costo per token, l'utilizzo della memoria e la rete a bassa latenza.
  • Architetto e ottimizza le condotte di inferenza ad alte prestazioni utilizzando i backend NVIDIA Dynamo, TensorRT-LLM, vLLM, SGLang e altri backend di inferenza, migliorando l'utilizzo della GPU e l'efficienza del cluster AI.
  • Traduci le intuizioni dei clienti e i modelli di distribuzione in feedback dei prodotti attuabili che sviluppa la roadmap per lo stack NVIDIA come Dynamo, TensorRT-LLM e NIM. Cosa dobbiamo vedere:
  • MS o PhD in Informatica, Ingegneria, o esperienza equivalente nel campo.
  • 8+ anni nell'infrastruttura AI/ML, con profonda esperienza nell'ottimizzazione dell'inferenza LLM/VLM e nella distribuzione della produzione su scala.
  • Profonda comprensione dell'accelerazione dell'inferenza del trasformatore: quantizzazione (INT4/FP8), decodifica speculativa, inferenza disaggregata, batch continuo, ottimizzazione della cache KV e WideEP per modelli MoE.
  • Comprendere le gerarchie di memoria GPU e la rete a bassa latenza con la loro influenza sulle prestazioni di inferenza.
  • Provato record di pista per condurre iniziative tecniche.

Cosa offre l’azienda

  • NVIDIA si impegna a promuovere un ambiente di lavoro diverso e orgoglioso di essere un datore di lavoro pari opportunità.
  • Poiché apprezziamo molto la diversità nei nostri dipendenti attuali e futuri, non discriminate (anche nelle nostre pratiche di assunzione e promozione) sulla base di razza, religione, colore, origine nazionale, sesso, espressione di genere, orientamento sessuale, età, stato civile, stato veterano, stato di disabilità o qualsiasi altra caratteristica protetta dalla legge.

Dettagli ulteriori

  • Allineando i membri del team chiave all'interno di NVIDIA e organizzazioni dei clienti, influenzerai le decisioni strategiche sulla tecnologia per sviluppare l'implementazione dell'inferenza AI di nuova generazione in scala.
  • Traduci le intuizioni dei clienti e i modelli di distribuzione in feedback dei prodotti attuabili che sviluppa la roadmap per lo stack NVIDIA come Dynamo, TensorRT-LLM e NIM. Cosa dobbiamo vedere:
  • Eccellente capacità di comunicazione, efficace con scienziati di ricerca, ingegneri delle infrastrutture e membri del team esecutivo. Modi per distinguersi dalla folla:
  • Il tuo stipendio base sarà determinato in base alla tua posizione, esperienza e la paga dei dipendenti in posizioni simili. Per la Polonia: la gamma di stipendio base è 292,500 PLN

Note e contenuto originale

  • Cosa farai:
  • Traduci le intuizioni dei clienti e i modelli di distribuzione in feedback dei prodotti attuabili che sviluppa la roadmap per lo stack NVIDIA come Dynamo, TensorRT-LLM e NIM.
  • Cosa dobbiamo vedere:
  • Eccellente capacità di comunicazione, efficace con scienziati di ricerca, ingegneri delle infrastrutture e membri del team esecutivo.
  • Modi per distinguersi dalla folla:
  • Il tuo stipendio base sarà determinato in base alla tua posizione, esperienza e la paga dei dipendenti in posizioni simili.
  • Per la Polonia: la gamma di stipendio base è 292,500 PLN
Vai alla candidatura

Domande frequenti su questo annuncio

Che stipendio offre NVIDIA (ufficio Zurich) per questa posizione?

NVIDIA (ufficio Zurich) indica CHF 113'500 - 172'000 lordi annui per questo ruolo a Zürich. Questo è lo stipendio pubblicato nell'annuncio originale (o, quando il datore non specifica una cifra, una stima realistica per ruolo e settore) — il calcolatore di questo sito lo converte nel netto reale una volta applicate imposta da frontaliere e contributi sociali.

È un ruolo a tempo pieno, e che tipo di contratto offre NVIDIA (ufficio Zurich)?

Questo annuncio è una posizione a tempo pieno. Il tipo di contratto mostrato qui arriva direttamente dall'annuncio originale del datore di lavoro; conferma sempre orario esatto, preavviso e durata del periodo di prova con NVIDIA (ufficio Zurich) durante il colloquio, perché questi dettagli possono variare anche all'interno della stessa categoria contrattuale.

Serve un permesso da frontaliere per un ruolo nel canton Zurigo?

I residenti UE/AELS nella zona di frontiera del paese confinante con il canton Zurigo possono richiedere il Permesso G; il datore di lavoro svizzero lo presenta all'ufficio della migrazione di quel canton dopo la firma del contratto. Regole sulla zona di frontiera e tempi di lavorazione variano per paese confinante e canton — verifica i dettagli con l'ufficio della migrazione del canton Zurigo o con HR durante il colloquio.

Come mi candido a questa posizione presso NVIDIA (ufficio Zurich)?

Usa il pulsante "Candidati ora" in questa pagina — rimanda direttamente all'annuncio originale di NVIDIA (ufficio Zurich) su nvidia.wd5.myworkdayjobs.com, quindi la tua candidatura arriva direttamente nel sistema di gestione candidature del datore di lavoro. Frontaliere Ticino non raccoglie né inoltra candidature in proprio.

Logo NVIDIA (ufficio Zurich)
Azienda
NVIDIA (ufficio Zurich) · Zürich
Frontaliere Ticino ha scovato questa opportunità nel monitoraggio aziende.

Tutte le offerte NVIDIA (ufficio Zurich) Zürich →

NVIDIA (ufficio Zurich): offerte di lavoro e stipendi →

Esplora annunci simili

Assumete? Pubblicate il vostro annuncio

Raggiungete ogni settimana migliaia di frontalieri e candidati locali: annuncio in evidenza, pagina SEO dedicata e segnalazione alla newsletter incluse.

Pubblica il tuo annuncio →