Aziende: Ricerca avanzata (LLM + multi-source)

action_company_search · action · Utility · Disponibile · v1.0.0

Descrizione

Discovery enterprise di URL di AZIENDE REALI per cold outreach B2B — la primitiva per costruire seed list di prospect target da zero senza dover comprare database statici come ZoomInfo/Apollo/SalesNavigator. Risolve il problema #1 del cold outreach moderno: trovare le aziende right-fit per il proprio prodotto nel territorio target, evitando il rumore di directory aggregatori (yellowpages, paginegialle, similarsites), blog content marketing che parlano del settore ma non ne sono parte attiva, link farm SEO che inquinano i risultati Google. Pipeline multi-stage avanzata: (1) LLM query expansion — l'utente passa una query high-level "cantieri navali Croazia 20-50m" e il LLM espande in 5-10 query specialized che catturano sinonimi industry ("shipyard Hrvatska", "yacht builders Croatia", "boat manufacturers Dalmatian coast", "production lines vessel 20m"), pattern per coverage che pura keyword search miss; (2) multi-source search parallel su 4 search engine indipendenti (Exa.ai per semantic neural search optimized per discovery, Tavily AI per recente fresh content, Brave Search per anti-Google bias, DuckDuckGo per privacy + independent results) — l'unione dei result set dei 4 sources è più completa di qualsiasi singolo; (3) anti-directory blocklist — filter post-processing che rimuove i top 200 directory/aggregator noti (yelp.com, yelp.it, paginegialle.it, europages.com, kompass.com, ecc.) che otherwise inquinano i result; (4) HEAD validation — quick HEAD request per ogni URL trovato per verificare che il sito risponde 200 (no 404/410 dead links, no 5xx down servers); (5) de-dup intelligente che matcha URL paths simili e domini canonical (www.acme.com vs acme.com). Output: array di { url, domain, title (dalla SERP), description (snippet), boost_factors (lista dei signal positivi che hanno ranked questo result), source (quale dei 4 search engines lo ha trovato), confidence } — ranking finale weighted per source di trust + match strength + freshness. LLM-agnostic per query expansion: lo step LLM usa il provider configurato del tenant (Liara Qwen3 self-hosted default zero-cost, oppure Anthropic Claude/OpenAI GPT/Gemini via BYOK). Use case: lead-gen B2B su nicchia verticale specifica (es. "produttori di pannelli fotovoltaici Sicilia 20MW+", "studi commercialisti specializzati in cripto-asset Milano"); discovery competitor nel mercato target prima di un lancio prodotto (mapping landscape competitivo); seed list per campagne ABM (account-based marketing) high-touch con messaggi ultra-customizzati per ogni account; prima fase di una pipeline downstream che poi arricchisce con contact-discovery (chi sono i decision-maker?) + email-validate-mx (sono email deliverable?) + personalization AI; analisi competitiva con scoring comparativo (chi sono i top 50 player del nostro mercato e dove sono attivi).

⚙️ Parametri di configurazione

Campi mostrati nell’editor quando si configura il nodo. Generati direttamente dal NodeDefconfigFields.

CampoTipoRequiredDefaultDescrizione
seedPrompt
Cosa cercare (prompt seed)
stringsi
yacht builder Italia, cantieri navali produttori
Descrizione di cosa cercare. L'LLM lo espanderà in N query DDG variate. PIÙ SPECIFICO = MIGLIORI RISULTATI: ✓ "cantieri navali yacht Italia produttori barche da diporto" ✗ "barche" (troppo generico) Suggerimenti: includi vertical + paese + ICP (es. "studi notarili Milano patrimonio", "officine meccaniche Brescia CNC").
maxResults
Numero massimo aziende
numberno20Hard cap di company URL ritornati DOPO tutti i filtri. • 5 = test rapido (~5s) • 20 = default bilanciato (~15s, 1 campagna ridotta) • 50 = ampio (~30s, 1 campagna completa) • 100 = max raccomandato (~60s, costo Tavily/Exa più alto)
queryExpansionCount
Query LLM-generate
numberno5Quante query variate l'LLM deve generare DA PARTIRE dal seed. • 0 = disabilita LLM (usa solo seed). Risparmia 1 token call ma minor copertura. • 3 = stretto, focus stretto sul vertical • 5 = default bilanciato (~50 risultati raw) • 10 = ampio, esplora più angoli (esempi: cantieri + officine + costruttori)
resultsPerQuery
Risultati per query
numberno10Quanti risultati prendere da ogni search engine per ogni query. • 5 = veloce, top-tier • 10 = default (coverage decente) • 20 = max (più chance di trovare aziende non-top-ranked) Costo: lineare con questo valore × query_count × provider_costs.
country
Codice paese ISO (TLD preference)
stringno
it, de, fr, es, uk, ...
ISO country code. Aziende con dominio .{country} ricevono boost di ranking. L'LLM include automaticamente "site:.{country}" in alcune query. Esempi: "it" per Italia, "de" per Germania, "fr" per Francia. Lascia vuoto per discovery global.
extraBlocklist
Domini da escludere (CSV)
stringno
concorrente1.com, partner.it, marketplace-x.com
Domini da escludere AGGIUNTIVI rispetto alla blocklist default (60+ directory già esclusi: yachtall, yachtworld, inautia, linkedin, facebook, amazon, ebay, ecc.). CSV. Use case: escludere concorrenti diretti, partner già contattati, marketplace specifici.
requireKeyword
Keyword OBBLIGATORIA nella homepage (avanzato)
stringno
yacht, marine, naval
Se settato, dopo il search il nodo fetch-a la homepage di ogni candidate e verifica la presenza del keyword (case-insensitive) in <title>/<meta>/<h1>. Se assente, l'URL viene scartato. AGGRESSIVO: scarta ~30-50% candidate, ma garantisce focus stretto sul vertical. Use case: vuoi SOLO siti che parlano del tuo target (no false positivi da search engine).
skipLLMExpansion
Salta LLM (usa solo seed query)
booleannofalseSe ON, NON chiama LLM per espandere il seed. Usa SOLO la query così com'è. Vantaggi: gratuito (0 token), più veloce (-2s), deterministico. Svantaggi: minor copertura, no variazione linguistica (italiano vs inglese). Use case: test rapidi, quando seedPrompt è già SuperOttimizzato.
validateTimeoutMs
Timeout HEAD validation (ms)
numberno5000HEAD request per filtrare siti morti. Accetta 200/405. • 0 = disabilita validation (più veloce, meno qualità) • 3000 = stretto (solo siti rapidissimi) • 5000 = default bilanciato • 10000 = tollerante (server lenti accettati)

⬆️ Output del nodo

Campi disponibili nei nodi successivi via $node.<alias>.json.<field>:

  • companies
  • urls
  • queries_used
  • queries_generated_by_llm
  • llm_provider
  • total_raw_results
  • filtered_directory
  • filtered_validation
  • took_ms
  • count

💡 Esempio configurazione

Snippet JSON del nodo come compare nel workflow. I valori sono derivati daidefaultValue e dai parametri required.

{
  "id": "node-action_company_search-1",
  "defId": "action_company_search",
  "label": "Aziende: Ricerca avanzata (LLM + multi-source)",
  "config": {
    "seedPrompt": "yacht builder Italia, cantieri navali produttori",
    "maxResults": 20,
    "queryExpansionCount": 5,
    "resultsPerQuery": 10,
    "skipLLMExpansion": false,
    "validateTimeoutMs": 5000
  }
}

🔗 Nodi correlati nella stessa categoria

Pronto a usare Aziende: Ricerca avanzata (LLM + multi-source)?

Disponibile da subito in tutti i piani FlowForge. Provalo gratis senza carta di credito.

Inizia gratisSfoglia tutti i nodi