Llm Systems Engineer (Milano)

Llm Systems Engineer (Milano)

01 ago
|
Iumob
|
Milano

01 ago

Iumob

Milano

Stiamo sviluppando una piattaforma di Intelligenza Artificiale generativa basata su modelli LLM open-weight eseguiti su infrastruttura proprietaria.
Cerchiamo un
LLM Systems Engineer
che progetti e realizzi l'infrastruttura AI alla base della piattaforma.
Responsabilità
Deploy e gestione di modelli LLM open-weight
Progettazione dell'architettura di inferenza
Sviluppo dell'infrastruttura di serving ad alte prestazioni
Implementazione di sistemi di memoria e orchestrazione
Ottimizzazione di latenza, throughput e utilizzo delle GPU
Sviluppo di pipeline di valutazione e monitoraggio
Requisiti
Esperienza concreta con la maggior parte delle seguenti tecnologie:
Python
FastAPI
Docker
Kubernetes
PostgreSQL
Redis
vLLM,



SGLang o TensorRT-LLM
llama.cpp
Hugging Face Transformers
CUDA
Quantizzazione e ottimizzazione dell'inferenza su GPU
È richiesta esperienza nella messa in produzione di sistemi basati su LLM.
Costituiscono titolo preferenziale
Inferenza multi-GPU
Architetture ad agenti
Sistemi di memoria persistente
Contributi a progetti open source
Candidatura
Inviare:
CV
Profilo GitHub
Profilo LinkedIn
Eventuali contributi open source rilevanti
Sede:
remoto (full remote)

📌 Llm Systems Engineer (Milano)
🏢 Iumob
📍 Milano

Candidati a questo annuncio

Mostra le tue capacità professionali all'azienda, compila il form e lascia un tocco personale nella lettera di presentazione, aiuterà il recruiter nella scelta del candidato.

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: llm systems engineer (milano) / milano

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: llm systems engineer (milano) / milano