Descrizione
Nodo generico LLM (Large Language Model) per generazione open-ended di testo o JSON strutturato, da qualsiasi prompt e con il provider configurato — la primitiva atomic di accesso alle capacità AI sottostanti la quale sono costruiti gli agent_* specializzati. Default: Liara Qwen3-32B FP8 self-hosted on-prem (vLLM su Hetzner Blackwell GEX131 RTX PRO 6000 96GB Falkenstein DE — zero trasferimento dati extra-UE, latenza p50 800ms, costo zero per il cliente nelle quote del piano). Override via BYOK con uno dei 9 provider esterni supportati: Anthropic Claude Sonnet 4 (state-of-art reasoning, $3/MTok input), OpenAI GPT-4o ($2.5/MTok input), Google Gemini 2.0 Flash (long-context, multimodale), DeepSeek-V3 ($0.27/MTok input, sweet spot prezzo/qualità), xAI Grok-2, OpenRouter (aggregator multi-modello), Mistral Large, Groq (LPU inference ultra-veloce su Llama-3 e Mixtral), Perplexity Sonar (web search integrata con citazioni live). Routing automatico via header X-FF-Provider gestito dal gateway LLM portal con quota mensile dedicata BYOK separata da Liara. Modalità output: testo plain (default — generazione discorsiva libera) oppure JSON structured (prompt include schema target + response_format json_object per Anthropic/OpenAI, fallback parsing per altri provider — validation downstream con Zod schema raccomandata). Temperature configurabile (0.0 deterministic per classifier, 0.7 default balanced, 1.0 creative per copywriting). max_tokens cap per controllo costo. Use case: scrittura di risposta email personalizzata multilingua per customer support B2B che integra context del cliente da memory_note (ordini precedenti, ticket aperti, preferenze comunicazione); generazione di descrizioni prodotto e-commerce SEO-friendly a partire dalla scheda tecnica raw del fornitore; classificazione di testo libero in categorie business custom non coperte da agent_* pre-tunati (es. classifier su 50 categorie merceologiche del settore agroalimentare); estrazione di entità strutturate da unstructured text (es. parse di paragrafi PEC ricevuti per estrarre partita_iva+importo+data_scadenza in JSON pronto per ingest contabile); brainstorming di idee marketing su brief ridotto per content creator. IMPORTANTE: se hai un task specifico ricorrente (triage email, sales reply, summarizer, translation, classifier ufficiale, intent routing), preferisci gli agent_* dedicati — sono pre-tunati con prompt engineering ottimizzato per quel task specifico, hanno output schema fisso testato, error handling specializzato, e tipicamente 2-3× più accurate vs prompt generico al action_llm_complete.
