Stiamo sviluppando una piattaforma di Intelligenza Artificiale generativa basata su modelli LLM open-weight eseguiti su infrastruttura proprietaria.
Cerchiamo un LLM Systems Engineer che progetti e realizzi l’infrastruttura AI alla base della piattaforma.
Responsabilità
- Deploy e gestione di modelli LLM open-weight
- Progettazione dell’architettura di inferenza
- Sviluppo dell’infrastruttura di serving ad alte prestazioni
- Implementazione di sistemi di memoria e orchestrazione
- Ottimizzazione di latenza, throughput e utilizzo delle GPU
- Sviluppo di pipeline di valutazione e monitoraggio
Requisiti
Esperienza concreta con la maggior parte delle seguenti tecnologie:
Mostra le tue capacità professionali all'azienda, compila il form e lascia un tocco personale nella lettera di presentazione, aiuterà il recruiter nella scelta del candidato.