Pubblica annuncio gratuito
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per llm engineer / italia

Llm Engineer

Pubblicato il 13-08-2026 - Altro in Italia

Senior Machine Learning Engineer / LLM Engineer
AGAP2 è un gruppo europeo di consulenza ingegneristica parte del gruppo MoOngy, presente in 14 paesi europei con oltre 8.500 dipendenti. La sede italiana si trova a Milano e, vista la continua crescita, stiamo rafforzando e ampliando il nostro team con persone che condividano i valori della nostra società: ambizione, dinamicità, voglia di mettersi in gioco e relazioni umane al primo posto.
Il ruolo si svolge all'interno di un team R&D; dedicato allo sviluppo di soluzioni proprietarie di Intelligenza Artificiale e prevede la progettazione, l'addestramento e la messa in produzione di modelli ML e LLM di ultima generazione.
Responsabilità
Architettura & Core AI – progettare e sviluppare pipeline AI basate su LLM, fine‐tuning di modelli open source, training di encoder/decoder, addestrare classificatori NLP e sistemi di text classification / intent detection.
RAG & Information Retrieval – implementare pipeline RAG avanzate (Chunking, Semantic/Hybrid Search, Reranking), costruire, ottimizzare e gestire Vector Database.




Serving & Infrastructure – deployment e scalabilità di modelli AI in atmosfera Kubernetes, ottimizzare le performance di inferenza e monitorare tramite metriche dedicate.
Innovazione – collaborare strettamente con il team R&D; per dare vita a nuove funzionalità AI proprietarie.
Tech Stack & Competenze Richieste
Python (ottima conoscenza), FastAPI (gradita).
LLM Open Source: Llama, Mistral, Gemma, Qwen, Phi.
Fine‐Tuning: LoRA, QLoRA, PEFT, Hugging Face Transformers.
Modelli Encoder: BERT, RoBERTa, DistilBERT, Sentence Transformers.
Vector DB: FAISS, Qdrant, Milvus, Chroma, Pinecone, Weaviate.
Model Serving: vLLM, Hugging Face TGI, Ollama, Ray Serve, TensorRT‐LLM.
MLOps & DevOps: Kubernetes, Docker, CI/CD, Git, MLflow.
Plus (Nice to Have): ottimizzazione GPU e gestione avanzata della VRAM, quantizzazione dei modelli, sistemi di batch inference e distributed inference, autoscaling applicato a modelli AI.
Equal Oppo

» RISPONDI A QUESTO ANNUNCIO
Altri Annunci
Mid-Market Sales Account Executive – Cyber Security
2026-08-14 06:53:43 - Accenture - Poreta
Mid-Market Sales Account Executive – Cyber SecurityAbout AccentureAccenture is a global professional services company with 800,000+ people in over 120 countries, helping organizations build their digital core, opt [...]
MAGAZZINIERE MULETTISTA TURNISTA O NOTTURNO
2026-08-14 06:53:39 - Adecco - Casale Monferrato
Unisciti alla squadra di Amazon. L'agenzia per il lavoro Adecco cerca una persona motivata per un ruolo a tempo pieno di Addetto/a allo smistamento per Amazon. Pronto/a a candidarsi? Prima di farlo, si assicuri d [...]
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per llm engineer / italia

Revenue Operations
2026-08-14 06:53:37 - Jet HR - Firenze
Cosa farai Possiede le competenze, l'esperienza e la determinazione necessarie per avere successo in questo ruolo? Lo scopra qui sotto. Ti occuperai di analizzare e migliorare i principali driver di crescita del [...]
Ispettore di opere d'arte maggiore senior
2026-08-14 06:53:37 - Manpower - Italia
Il nostro Cliente: Società ingegneristica Ci ha incaricati di ricercare un/una:ISPETTORE OPERE D'ARTE MAGGIORI SRSede di lavoro: TorinoIl lavoro:La risorsa si occuperà di Pianificazione ed effettuazione delle atti [...]