Senior Machine Learning Engineer / LLM Engineer
AGAP2 è un gruppo europeo di consulenza ingegneristica parte del gruppo MoOngy, presente in 14 paesi europei con oltre 8.500 dipendenti. La sede italiana si trova a Milano e, vista la continua crescita, stiamo rafforzando e ampliando il nostro team con persone che condividano i valori della nostra società: ambizione, dinamicità, voglia di mettersi in gioco e relazioni umane al primo posto.
Il ruolo si svolge all'interno di un team R&D; dedicato allo sviluppo di soluzioni proprietarie di Intelligenza Artificiale e prevede la progettazione, l'addestramento e la messa in produzione di modelli ML e LLM di ultima generazione.
Responsabilità
Architettura & Core AI – progettare e sviluppare pipeline AI basate su LLM, fine‐tuning di modelli open source, training di encoder/decoder, addestrare classificatori NLP e sistemi di text classification / intent detection.
RAG & Information Retrieval – implementare pipeline RAG avanzate (Chunking, Semantic/Hybrid Search, Reranking), costruire, ottimizzare e gestire Vector Database.
Serving & Infrastructure – deployment e scalabilità di modelli AI in atmosfera Kubernetes, ottimizzare le performance di inferenza e monitorare tramite metriche dedicate.
Innovazione – collaborare strettamente con il team R&D; per dare vita a nuove funzionalità AI proprietarie.
Tech Stack & Competenze Richieste
Python (ottima conoscenza), FastAPI (gradita).
LLM Open Source: Llama, Mistral, Gemma, Qwen, Phi.
Fine‐Tuning: LoRA, QLoRA, PEFT, Hugging Face Transformers.
Modelli Encoder: BERT, RoBERTa, DistilBERT, Sentence Transformers.
Vector DB: FAISS, Qdrant, Milvus, Chroma, Pinecone, Weaviate.
Model Serving: vLLM, Hugging Face TGI, Ollama, Ray Serve, TensorRT‐LLM.
MLOps & DevOps: Kubernetes, Docker, CI/CD, Git, MLflow.
Plus (Nice to Have): ottimizzazione GPU e gestione avanzata della VRAM, quantizzazione dei modelli, sistemi di batch inference e distributed inference, autoscaling applicato a modelli AI.
Equal Oppo
📌 Llm Engineer (Italia)
🏢 Altro
📍 Italia