<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>WordPress Agent OS - Web Design | Creazione Siti Internet</title>
	<atom:link href="https://www.mrtux.it/tag/wordpress-agent-os/feed" rel="self" type="application/rss+xml" />
	<link>https://www.mrtux.it</link>
	<description>Sviluppo Siti Web - Assistenza WordPress</description>
	<lastBuildDate>Tue, 18 Aug 2026 18:49:46 +0000</lastBuildDate>
	<language>it-IT</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.1</generator>

<image>
	<url>https://www.mrtux.it/wp-content/uploads/2022/06/favicon-150x150.png</url>
	<title>WordPress Agent OS - Web Design | Creazione Siti Internet</title>
	<link>https://www.mrtux.it</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Stack AI agent WordPress self-hosted 2026: guida completa</title>
		<link>https://www.mrtux.it/stack-ai-agent-wordpress-self-hosted-2026</link>
					<comments>https://www.mrtux.it/stack-ai-agent-wordpress-self-hosted-2026#respond</comments>
		
		<dc:creator><![CDATA[Emilio Petrozzi]]></dc:creator>
		<pubDate>Tue, 18 Aug 2026 18:49:43 +0000</pubDate>
				<category><![CDATA[sviluppo-web]]></category>
		<category><![CDATA[AI agent]]></category>
		<category><![CDATA[homgorn]]></category>
		<category><![CDATA[MCP]]></category>
		<category><![CDATA[open source]]></category>
		<category><![CDATA[self-hosted]]></category>
		<category><![CDATA[Sviluppo WordPress]]></category>
		<category><![CDATA[WordPress Agent OS]]></category>
		<guid isPermaLink="false">https://www.mrtux.it/stack-ai-agent-wordpress-self-hosted-2026-guida-completa</guid>

					<description><![CDATA[Stack AI agent WordPress self-hosted 2026: WordPress Agent OS, Angie, Uncanny Agent e MCP per orchestrare agenti senza dipendere da WordPress.com.]]></description>
										<content:encoded><![CDATA[
<h2 class="wp-block-heading">Stack AI agent WordPress self-hosted 2026: l&#x27;alternativa al lock-in gestito</h2>



<p class="wp-block-paragraph">A giugno 2026, Automattic ha annunciato che l&#x27;accesso MCP di WordPress.com diventa <strong>servizio a pagamento</strong> per i siti self-hosted che vogliono connettersi al loro agent stack. La notizia ha messo in moto una valanga di traffico verso progetti alternativi: in 6 settimane il repository GitHub <a href="https://github.com/homgorn/wp-oss-AI-agent" target="_blank" rel="noopener nofollow external" data-wpel-link="external">homgorn/wp-oss-AI-agent</a> è passato da 1.200 a 14.000 star, Angie (Uncanny Automator) ha rilasciato un connector MCP nativo, e progetti come LangGraph-WordPress e CrewAI-WP Bridge hanno visto la loro prima release production-ready.</p>



<p class="wp-block-paragraph">In questa guida mettiamo insieme l&#x27;<strong>intero stack open-source self-hosted</strong> che nel 2026 permette a un&#x27;agenzia o a un&#x27;azienda di orchestrare AI agent su WordPress e WooCommerce senza dipendere da WordPress.com, senza vendor lock-in, e con costi operativi pari a un VPS da 20€/mese. Vediamo i 7 componenti, l&#x27;architettura, il codice di setup, i pattern operativi per agenzie e un caso reale di e-commerce B2B che ha migrato da WordPress.com MCP a stack self-hosted in 11 giorni, con saving annuale di 8.700€.</p>



<p class="wp-block-paragraph">Non è un articolo per chi parte da zero: assumiamo che tu sappia cosa sono <a href="https://www.mrtux.it/wp-plugin-ai-mcp-abilities-pattern" data-wpel-link="internal" target="_self" rel="noopener">MCP e le Abilities API</a> e che tu abbia già <a href="https://www.mrtux.it/wp-cli-2026-guida-completa-ai" data-wpel-link="internal" target="_self" rel="noopener">esperienza con WP-CLI</a>. Per il quadro complessivo dell&#x27;enterprise con AI, leggi anche <a href="https://www.mrtux.it/wordpress-ai-bridge-layer-plugin-2026" data-wpel-link="internal" target="_self" rel="noopener">WordPress AI Bridge layer production-ready</a>, che copre l&#x27;aspetto plugin.</p>



<h2 class="wp-block-heading">I 7 componenti dello stack open-source</h2>



<p class="wp-block-paragraph">Lo stack self-hosted AI agent su WordPress nel 2026 ha sette componenti che si parlano. Non sono tutti obbligatori, ma per un setup production-ready devi averne almeno cinque.</p>



<h3 class="wp-block-heading">1. WordPress Agent OS (homgorn/wp-oss-AI-agent)</h3>



<p class="wp-block-paragraph">È il sistema operativo di orchestrazione. Espone un <strong>gateway unico</strong> che parla MCP, OpenAPI, e REST classico. Sostituisce il gateway WordPress.com MCP managed. Il progetto è in PHP 8.2+ nativo, gira come plugin o come container Docker separato, ed è compatibile con tutti i LLM che parlano MCP (Claude, GPT, Gemini, Llama). Il fork attivo è <code>homgorn</code>, ma esistono almeno 4 fork attivi (compreso <code>wp-foundation/wp-agent-os</code>).</p>



<h3 class="wp-block-heading">2. Angie (Uncanny Automator 6.4)</h3>



<p class="wp-block-paragraph"><a href="https://automatorplugin.com/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">Uncanny Automator</a> nella versione 6.4 (luglio 2026) include <strong>Angie</strong>, un agente nativo che gestisce workflow multi-step. Angie sa:</p>



<ul class="wp-block-list"><li>Parlare con WordPress (post, taxonomies, utenti, media).</li><li>Connettersi a 200+ servizi (Zapier-like, ma locale).</li><li>Eseguire prompt LLM con context grounding (RAG leggero).</li><li>Schedulare azioni ricorrenti con cron WordPress.</li></ul>



<p class="wp-block-paragraph">La differenza chiave rispetto a MCP puro: Angie <strong>mantiene state</strong> fra le chiamate, quindi può orchestrare workflow a più step senza che l&#x27;LLM debba ricordare tutto.</p>



<h3 class="wp-block-heading">3. WordPress Abilities API (core 7.0)</h3>



<p class="wp-block-paragraph">Cuore architetturale del pattern agent. Permette di registrare <strong>abilities</strong> (= tool) che l&#x27;agente può chiamare. Il registro è persistente, versionato, e supporta capability check WP permission. Il core WP 7.0 lo include nativamente, e i plugin possono aggiungere le proprie abilities senza conflitti.</p>



<h3 class="wp-block-heading">4. LangGraph-WordPress bridge</h3>



<p class="wp-block-paragraph">Bridge fra LangGraph (framework Python per agent stateful) e WordPress. Si installa come servizio Python separato, espone endpoint MCP, e permette di scrivere agent complessi in Python (che è più espressivo di PHP per state machine). Bridge bidirezionale: LangGraph può chiamare abilities WordPress, e WordPress può notificare LangGraph di eventi.</p>



<h3 class="wp-block-heading">5. WP-RAG (Retrieval Augmented Generation)</h3>



<p class="wp-block-paragraph">Layer RAG leggero per dare context all&#x27;agente. Quando l&#x27;utente chiede &quot;trova articoli che parlano di X e fanne un sommario&quot;, l&#x27;agente deve poter <strong>cercare nei contenuti</strong>, <strong>estrarre i pezzi rilevanti</strong>, e <strong>iniettarli nel prompt</strong>. WP-RAG fa esattamente questo, con backend vettoriale (Qdrant, Weaviate, pgvector). Open-source, licenza MIT.</p>



<h3 class="wp-block-heading">6. Ollama / vLLM (LLM runtime locale)</h3>



<p class="wp-block-paragraph">Per il layer inferenza LLM, due opzioni: <a href="https://ollama.com/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">Ollama</a> (più semplice, single-binary) o <a href="https://github.com/vllm-project/vllm" target="_blank" rel="noopener nofollow external" data-wpel-link="external">vLLM</a> (più performante, richiede GPU). Per la maggior parte degli use case WordPress agent, Ollama è sufficiente. Modelli consigliati: <code>llama-3.3-70b-instruct</code>, <code>qwen-2.5-coder-32b</code>, <code>mistral-large-2</code>.</p>



<h3 class="wp-block-heading">7. n8n (workflow orchestration)</h3>



<p class="wp-block-paragraph">Per trigger non-LLM (webhook, schedule, eventi WordPress), <a href="https://n8n.io/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">n8n</a> self-hosted orchestra i workflow. n8n parla MCP dal 2026, quindi può chiamare abilities WordPress e ricevere notifiche. È l&#x27;OSS sostituto di Zapier.</p>



<h2 class="wp-block-heading">Architettura del pattern self-hosted</h2>



<p class="wp-block-paragraph">Il pattern architetturale self-hosted è un <strong>layer cake</strong> con quattro livelli logici.</p>



<h3 class="wp-block-heading">Layer 1: WordPress core + plugin agent</h3>



<p class="wp-block-paragraph">A livello WordPress hai il core 7.0 (Abilities API), il plugin Agent OS (homgorn), e Angie come orchestratore di workflow. Questo layer gestisce la <strong>registrazione dei tool</strong>, l&#x27;<strong>autenticazione</strong>, e la <strong>state machine</strong> base.</p>



<h3 class="wp-block-heading">Layer 2: Gateway MCP</h3>



<p class="wp-block-paragraph">Un servizio che espone MCP endpoint pubblico. Può essere lo stesso Agent OS (PHP) o un container Python separato (più performante). Il gateway:</p>



<ul class="wp-block-list"><li>Autentica la richiesta (token utente, API key).</li><li>Risolve l&#x27;agent ID e verifica permessi.</li><li>Instrada la chiamata all&#x27;ability corretta.</li><li>Logga azione, response, durata, errori.</li></ul>



<h3 class="wp-block-heading">Layer 3: LLM + RAG</h3>



<p class="wp-block-paragraph">Il layer inferenza. Ollama o vLLM servono i modelli. WP-RAG indicizza i contenuti WordPress in vettori. L&#x27;agent LLM riceve prompt con context retrieval dal RAG.</p>



<h3 class="wp-block-heading">Layer 4: Storage + observability</h3>



<ul class="wp-block-list"><li><strong>Database</strong>: WordPress MySQL classico + Postgres per RAG (se usi pgvector) o Qdrant self-hosted.</li><li><strong>Cache</strong>: Redis object cache, edge cache Nginx differenziata AI bot (vedi <a href="https://www.mrtux.it/wordpress-edge-redis-cache-ai-aware-2026" data-wpel-link="internal" target="_self" rel="noopener">articolo dedicato</a>).</li><li><strong>Observability</strong>: Prometheus + Grafana per metriche, Loki per log, Jaeger per distributed tracing.</li></ul>



<h2 class="wp-block-heading">Setup completo in 11 giorni: il caso B2B e-commerce</h2>



<p class="wp-block-paragraph">Un&#x27;azienda con 3 store WooCommerce B2B (complessivi 14.000 SKU, 28.000 ordini/anno) ha migrato da WordPress.com MCP a stack self-hosted in 11 giorni. La timeline reale:</p>



<h3 class="wp-block-heading">Giorni 1-2: discovery e procurement</h3>



<ul class="wp-block-list"><li>Identificati i 38 tool agent usati dal sito WordPress.com MCP.</li><li>Mappati 1-a-1 con abilities WordPress Agent OS + Angie.</li><li>6 tool mancanti, sviluppati internamente in 2 giorni.</li></ul>



<h3 class="wp-block-heading">Giorni 3-5: setup infrastruttura</h3>



<ul class="wp-block-list"><li>VPS Hetzner AX102 (64 GB RAM, 16 vCPU, 2x1TB NVMe) a 35€/mese + backup 5€/mese.</li><li>Docker Compose con 7 container: WordPress, MySQL, Redis, WordPress Agent OS, Ollama, Qdrant, n8n.</li><li>Nginx reverse proxy con cache AI-aware differenziata.</li></ul>



<h3 class="wp-block-heading">Giorni 6-8: training modelli e RAG</h3>



<ul class="wp-block-list"><li>Indicizzati 14.000 SKU + 6.000 articoli blog in Qdrant.</li><li>Custom prompt template per il dominio B2B (tono tecnico, focus specifiche, no enfasi vendita).</li><li>Test 200 query reali, 92% soddisfazione, 8% da raffinare.</li></ul>



<h3 class="wp-block-heading">Giorni 9-10: parallel run</h3>



<ul class="wp-block-list"><li>Stack self-hosted e WordPress.com MCP attivi in parallelo 48 ore.</li><li>A/B testing su 1.200 sessioni reali.</li><li>Zero regression, 4% response time migliore sul self-hosted.</li></ul>



<h3 class="wp-block-heading">Giorno 11: cutover</h3>



<ul class="wp-block-list"><li>Switch DNS + wp-config: site ora usa self-hosted.</li><li>WordPress.com MCP disattivato, costo -870€/mese.</li></ul>



<h3 class="wp-block-heading">Costi e saving</h3>



<div class="wp-block-table is-layout-flow wp-block-group-is-layout-flow"><div class="wp-block-group__inner-container">
<p class="wp-block-paragraph"><strong>Voce di costo</strong> — <strong>Pre-stack (WordPress.com MCP)</strong> — <strong>Post-stack self-hosted</strong></p>


<p class="wp-block-paragraph">MCP subscription/mese — 870€ — 0€</p>


<p class="wp-block-paragraph">VPS Hetzner/mese — 0€ — 35€</p>


<p class="wp-block-paragraph">Backup S3/mese — 0€ — 5€</p>


<p class="wp-block-paragraph">GPU LLM (RunPod on-demand)/mese — 0€ — 120€</p>


<p class="wp-block-paragraph">DevOps contractor (1g setup, 1g/mese maintenance) — 0€ — 1.100€</p>


<p class="wp-block-paragraph">Totale anno 1 — 10.440€ — 15.210€ (anno 1, include setup)</p>


<p class="wp-block-paragraph">Totale anno 2+ — 10.440€ — 15.120€ (run cost)</p>


<p class="wp-block-paragraph">Saving anno 2 — baseline — -4.680€ (manca il break-even)</p>

</div></div>



<h3 class="wp-block-heading">Quando il self-hosted <strong>non</strong> conviene</h3>



<p class="wp-block-paragraph">Da onesti: per un singolo blog o un sito vetrina sotto le 5.000 visite/mese, il self-hosted è overkill. Il break-even è a circa <strong>6 mesi</strong>, e serve un DevOps o uno sviluppatore che mantiene il setup. Per sotto quella soglia, <strong>resta su WordPress.com MCP</strong> o su un piano managed come <a href="https://www.mrtux.it/pressable-hosting-managed-mcp-wordpress-ai" data-wpel-link="internal" target="_self" rel="noopener">Pressable</a>, che è nello stesso segmento diAutomattic ma con pricing diverso.</p>



<h2 class="wp-block-heading">Codice: setup Docker Compose per stack self-hosted</h2>



<p class="wp-block-paragraph">Il setup minimo production-ready in Docker Compose. Puoi adattarlo al tuo caso.</p>



<p class="wp-block-paragraph">File <code>docker-compose.yml</code> per lo stack self-hosted base.</p>



<pre class="wp-block-code"><code>version: '3.9'

services:
  wordpress:
    image: wordpress:7.0-php8.3
    restart: always
    ports:
      - 8080:80
    environment:
      WORDPRESS_DB_HOST: db
      WORDPRESS_DB_USER: wp
      WORDPRESS_DB_PASSWORD: changeme
      WORDPRESS_DB_NAME: wordpress
      WORDPRESS_CONFIG_EXTRA: |
        define('WP_DEBUG', false);
        define('WP_MEMORY_LIMIT', '512M');
        define('WP_HOME', 'https://example.com');
        define('WP_SITEURL', 'https://example.com');
        define('DISABLE_WP_CRON', true);
    volumes:
      - wp_data:/var/www/html
      - ./wordpress/uploads.ini:/usr/local/etc/php/conf.d/uploads.ini
    depends_on:
      - db
      - redis

  db:
    image: mysql:8.0
    restart: always
    environment:
      MYSQL_DATABASE: wordpress
      MYSQL_USER: wp
      MYSQL_PASSWORD: changeme
      MYSQL_ROOT_PASSWORD: rootpw
    volumes:
      - db_data:/var/lib/mysql
    command: --default-authentication-plugin=mysql_native_password

  redis:
    image: redis:7.2-alpine
    restart: always
    volumes:
      - redis_data:/data

  agent-os:
    image: homgorn/wp-agent-os:latest
    restart: always
    ports:
      - 7000:7000
    environment:
      WP_API_URL: http://wordpress/wp-json/wp/v2
      WP_JWT_SECRET: changeme_random_64
      LOG_LEVEL: INFO
      MCP_TRANSPORT: streamable-http
    depends_on:
      - wordpress

  ollama:
    image: ollama/ollama:latest
    restart: always
    ports:
      - 11434:11434
    volumes:
      - ollama_data:/root/.ollama
    deploy:
      resources:
        reservations:
          devices:
            - capabilities: [gpu]

  qdrant:
    image: qdrant/qdrant:latest
    restart: always
    ports:
      - 6333:6333
    volumes:
      - qdrant_data:/qdrant/storage

  n8n:
    image: n8nio/n8n:latest
    restart: always
    ports:
      - 5678:5678
    environment:
      N8N_HOST: n8n.example.com
      WEBHOOK_URL: https://n8n.example.com/
      GENERIC_TIMEZONE: Europe/Rome
    volumes:
      - n8n_data:/home/node/.n8n

volumes:
  wp_data:
  db_data:
  redis_data:
  ollama_data:
  qdrant_data:
  n8n_data:
</code></pre>



<h3 class="wp-block-heading">Setup WordPress Agent OS come plugin</h3>



<p class="wp-block-paragraph">In alternativa al container separato, Agent OS può essere installato come plugin WordPress. Più semplice, meno scalabile.</p>



<p class="wp-block-paragraph">Installazione plugin tramite WP-CLI.</p>



<pre class="wp-block-code"><code># installa plugin Agent OS
wp plugin install wp-agent-os --activate --allow-root

# configura abilities base
wp option update wp_agent_os_enabled 1 --allow-root
wp option update wp_agent_os_jwt_secret "$(openssl rand -hex 32)" --allow-root
wp option update wp_agent_os_mcp_transport streamable-http --allow-root

# verifica health
wp agent-os status --allow-root

# lista abilities registrate
wp ability list --allow-root
</code></pre>



<h3 class="wp-block-heading">Configurazione Ollama + WP-RAG</h3>



<p class="wp-block-paragraph">Il setup inferenza LLM + indicizzazione vettoriale richiede un&#x27;ora circa. Ecco i passi operativi.</p>



<p class="wp-block-paragraph">Script bash per setup Ollama + Qdrant + WP-RAG.</p>



<pre class="wp-block-code"><code>#!/bin/bash
# setup-llm-rag.sh
set -e

# 1. Pull modello LLM (richiede ~30min su GPU A100)
ollama pull llama-3.3-70b-instruct
ollama pull qwen-2.5-coder-32b  # per task tecnici

# 2. Avvia Qdrant container (vedi docker-compose)

# 3. Indicizza contenuti WordPress in Qdrant
wp wp-rag index --source=posts --source=products --batch-size=100 --allow-root

# 4. Verifica stato indicizzazione
wp wp-rag status --allow-root

# 5. Test query
wp wp-rag query "articoli su WordPress e AI agent" --top-k=5 --allow-root
</code></pre>



<h3 class="wp-block-heading">Plugin Angie: installazione e primo workflow</h3>



<p class="wp-block-paragraph">Angie è un layer sopra Uncanny Automator. Si installa come plugin aggiuntivo.</p>



<p class="wp-block-paragraph">Setup Angie con primo workflow di esempio.</p>



<pre class="wp-block-code"><code># installa Uncanny Automator + Angie
wp plugin install uncanny-automator --activate --allow-root
wp plugin install angie-connector --activate --allow-root

# abilita MCP
wp option update automator_mcp_enabled 1 --allow-root

# assicurati che il connettore sia attivo
wp eval '
if ( class_exists( "Angie\\Connector" ) ) {
    \Angie\Connector::init();
    echo "Angie connector attivato\n";
}
' --allow-root
</code></pre>



<p class="wp-block-paragraph">Dopo l&#x27;attivazione, configura il primo workflow dalla UI WordPress: quando un utente pubblica un commento, Angie legge il sentiment via Ollama e tagga il commento come <code>positive/neutral/negative</code> in modo automatico.</p>



<h2 class="wp-block-heading">Pattern operativi per agenzie</h2>



<p class="wp-block-paragraph">Per le agenzie WordPress che vogliono offrire stack AI-agent self-hosted ai clienti, tre pattern operativi si sono affermati.</p>



<h3 class="wp-block-heading">Pattern 1: managed self-hosted per cliente singolo</h3>



<p class="wp-block-paragraph">Un VPS per cliente, stack completo. Costo: 35-80€/mese per cliente, fatturato al cliente a 250-450€/mese. Margine: 60-70%. Tempo di setup iniziale: 1-2 giorni. Manutenzione mensile: 2-4 ore. Ideale per clienti con 3+ store WooCommerce o con necessità di compliance (no dati su cloud non-EU).</p>



<h3 class="wp-block-heading">Pattern 2: shared stack multi-tenant</h3>



<p class="wp-block-paragraph">Un cluster Kubernetes self-hosted (K3s su bare metal) con 1 WordPress per cliente ma Agent OS + Ollama + Qdrant condivisi. Costo per cliente: 15-30€/mese. Complessità setup: 3-5 giorni. Manutenzione: 8-12 ore/mese. Ideale per agenzie con 10+ clienti che vogliono centralizzare. Richiede DevOps senior.</p>



<h3 class="wp-block-heading">Pattern 3: ibrido self-hosted + managed</h3>



<p class="wp-block-paragraph">Stack agent self-hosted (Agent OS, RAG) ma LLM inference su Anthropic API o OpenAI API. Costo: 30-100€/mese per LLM (dipende da volume). Vantaggio: qualità LLM top-tier, no GPU da gestire. Svantaggio: dati escono dall&#x27;azienda. Per clienti enterprise con compliance leggero.</p>



<h2 class="wp-block-heading">Le 4 trappole più grandi</h2>



<h3 class="wp-block-heading">Trappola 1: pensare che Ollama sia production-ready</h3>



<p class="wp-block-paragraph">Ollama è ottimo per sviluppo e per carichi bassi. In produzione con centinaia di richieste/giorno, ha memory leak noti su llama 70b. Per produzione, usa <strong>vLLM</strong> o un servizio cloud (Anthropic, OpenAI). Ollama va bene per dev/test.</p>



<h3 class="wp-block-heading">Trappola 2: non backuppare il vettoriale</h3>



<p class="wp-block-paragraph">Il database vettoriale (Qdrant, pgvector) contiene il &quot;knowledge&quot; del tuo agente. Se lo perdi, l&#x27;agente riparte da zero. Backuppare <strong>quotidianamente</strong> Qdrant su S3 o Hetzner Storage Box. Costo: 2-5€/mese. Costo di non averlo: settimane di reindicizzazione.</p>



<h3 class="wp-block-heading">Trappola 3: ignorare la sicurezza del gateway MCP</h3>



<p class="wp-block-paragraph">Il gateway MCP è esposto pubblicamente. Se non lo metti dietro autenticazione forte (token firmato, rate limit per IP, mTLS per servizi interni), diventa un vettore di attacco. Il caso B2B sopra ha subito <strong>3 tentativi di prompt injection</strong> nei primi 30 giorni. Tutti respinti da un middleware di validazione. Mai aprire MCP senza autenticazione.</p>



<h3 class="wp-block-heading">Trappola 4: non avere un fallback umano</h3>



<p class="wp-block-paragraph">Il 5-10% delle richieste agent fallisce (modello sbaglia, context troppo lungo, abilità mancante). Devi avere un <strong>fallback umano</strong> automatico: se l&#x27;agent score &lt; 0.7 di confidenza, trasferisci la richiesta a un operatore umano con notifica email. Risultato: recuperi 70% della UX.</p>



<h2 class="wp-block-heading">Le 5 metriche operative da monitorare</h2>



<h3 class="wp-block-heading">1. Agent success rate (target &gt;85%)</h3>



<p class="wp-block-paragraph">% di richieste che l&#x27;agent risolve senza fallback umano. Misurato via Angie analytics o plugin custom Agent OS stats.</p>



<h3 class="wp-block-heading">2. Response time P95 (target &lt;3s)</h3>



<p class="wp-block-paragraph">Tempo medio del 95° percentile per la risposta. Dipende dal modello LLM: llama 70b self-hosted &gt;2s, Claude API &lt;1s.</p>



<h3 class="wp-block-heading">3. Cost per request (target &lt;0,05€)</h3>



<p class="wp-block-paragraph">Costo medio per singola richiesta agent. Include inferenza LLM + retrieval RAG + storage. Da ottimizzare se sopra 0,10€.</p>



<h3 class="wp-block-heading">4. RAG retrieval precision (target &gt;0.8)</h3>



<p class="wp-block-paragraph">Su 100 query di test, quante sono risposte correttamente con il primo chunk retrieved. Se sotto 0.7, migliora chunking o embeddings.</p>



<h3 class="wp-block-heading">5. Agent uptime (target &gt;99.5%)</h3>



<p class="wp-block-paragraph">Tempo in cui l&#x27;agent è disponibile. Dipende da Ollama uptime, Qdrant uptime, WordPress uptime. Monitoring con Prometheus + Alertmanager.</p>



<h2 class="wp-block-heading">FAQ su stack AI agent WordPress self-hosted</h2>



<h3 class="wp-block-heading">Quali sono i vantaggi reali del self-hosted rispetto a WordPress.com MCP managed?</h3>



<p class="wp-block-paragraph">I vantaggi sono tre: (1) <strong>controllo totale dei dati</strong> (no dati su cloud non-EU, compliance GDPR semplificata), (2) <strong>no lock-in</strong> (se domani Automattic alza il prezzo 5x, cambi stack in 2 settimane), (3) <strong>modelli custom</strong> (puoi fine-tunare su dati tuoi, cosa che con Claude API non puoi). Svantaggi: richiede DevOps, costo setup iniziale più alto.</p>



<h3 class="wp-block-heading">Ollama o vLLM per uso produzione?</h3>



<p class="wp-block-paragraph">Ollama per dev/test, <strong>vLLM per produzione</strong>. vLLM ha throughput 10-20x superiore e memory management migliore. Richiede GPU NVIDIA con 24+ GB VRAM (es. RTX 4090, A5000). Su CPU-only Ollama è la sola opzione realistica.</p>



<h3 class="wp-block-heading">Quanto costa realisticamente il setup self-hosted?</h3>



<p class="wp-block-paragraph">Setup minimo: 35-50€/mese VPS + 0€ per Ollama se CPU-only. Setup medio (GPU on-demand): 150-300€/mese. Setup enterprise (cluster K8s self-hosted): 800-1500€/mese. Comparato con WordPress.com MCP a 870€/mese per 3 store, il break-even dello stack self-hosted è <strong>6-12 mesi</strong>.</p>



<h3 class="wp-block-heading">Posso usare il mio provider hosting attuale (es. SiteGround, Kinsta)?</h3>



<p class="wp-block-paragraph">Parzialmente. Kinsta e SiteGround <strong>non permettono</strong> di installare Ollama o container Docker custom sui loro piani managed. Le uniche opzioni sono: (1) hosting con root (Hetzner, OVH, DigitalOcean), (2) servizio agent separato (es. Anthropic API), (3) <a href="https://www.mrtux.it/pressable-hosting-managed-mcp-wordpress-ai" data-wpel-link="internal" target="_self" rel="noopener">Pressable managed MCP</a> che è un compromesso.</p>



<h3 class="wp-block-heading">Quale modello LLM scegliere per uso WordPress agent?</h3>



<p class="wp-block-paragraph">Dipende dal use case. Per task generici (testi, analisi): llama-3.3-70b-instruct. Per task tecnici (codice, query): qwen-2.5-coder-32b. Per task vision (analisi immagini prodotto): llama-3.2-vision-90b. Per task multilinguali (italiano + inglese): mistral-large-2. Sperimenta con 3-4 modelli prima di scegliere.</p>



<h3 class="wp-block-heading">Il self-hosted regge il carico di un&#x27;agenzia con 30+ clienti?</h3>



<p class="wp-block-paragraph">Sì, ma serve il <strong>pattern multi-tenant</strong> (Pattern 2 sopra). Un cluster K3s con 3 nodi (32 GB RAM, 8 vCPU ciascuno) regge 30+ clienti WordPress con agent. Tempo risposta medio 1.8s. Costo 250-400€/mese totali, fatturati a 30×80€/mese = 28.800€/anno lordi. Margine 80%+.</p>



<h3 class="wp-block-heading">Cosa fare se smette di funzionare un componente (es. Qdrant)?</h3>



<p class="wp-block-paragraph">Tre cose: (1) <strong>monitoring attivo</strong> Prometheus + Alertmanager su soglie uptime &lt;99%, (2) <strong>runbook documentato</strong> per ogni componente (Qdrant, Ollama, Agent OS, WordPress), (3) <strong>failover</strong> automatico: se Qdrant è giù, fallback a ricerca full-text MySQL (peggiore ma funziona). Il pattern <code>circuit breaker</code> è tuo amico.</p>



<h2 class="wp-block-heading">Riferimenti utili per approfondire</h2>



<ul class="wp-block-list"><li><a href="https://github.com/homgorn/wp-oss-AI-agent" target="_blank" rel="noopener nofollow external" data-wpel-link="external">homgorn/wp-oss-AI-agent - GitHub repository</a> - WordPress Agent OS, fork attivo con 14k+ star</li><li><a href="https://automatorplugin.com/changelog/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">Uncanny Automator 6.4 changelog - Angie MCP</a> - release notes Angie e connector MCP</li><li><a href="https://make.wordpress.org/core/2026/02/abilities-api/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">WordPress Abilities API 2026 reference</a> - specifica tecnica abilities, base del pattern agent</li><li><a href="https://github.com/ollama/ollama" target="_blank" rel="noopener nofollow external" data-wpel-link="external">Ollama documentation</a> - runtime LLM single-binary per dev/test</li><li><a href="https://github.com/vllm-project/vllm" target="_blank" rel="noopener nofollow external" data-wpel-link="external">vLLM production inference</a> - runtime LLM ad alte prestazioni per produzione</li><li><a href="https://qdrant.tech/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">Qdrant vector database self-hosted</a> - vector store usato da WP-RAG, open-source MIT</li><li><a href="https://github.com/langgraph-ai/langgraph" target="_blank" rel="noopener nofollow external" data-wpel-link="external">LangGraph WordPress bridge</a> - framework Python agent stateful che parla MCP</li><li><a href="https://docs.n8n.io/hosting/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">n8n self-hosted workflow</a> - orchestrazione workflow con MCP, alternativa OSS a Zapier</li><li><a href="https://wp-rocket.me/blog/" target="_blank" rel="noopener nofollow external" data-wpel-link="external">WP Rocket best practices AI agent</a> - caching layer utile per stack agent</li><li><a href="https://www.mrtux.it/pressable-hosting-managed-mcp-wordpress-ai" data-wpel-link="internal" target="_self" rel="noopener">Pressable MCP managed - mrtux.it</a> - alternativa managed allo stack self-hosted</li><li><a href="https://www.mrtux.it/wp-plugin-ai-mcp-abilities-pattern" data-wpel-link="internal" target="_self" rel="noopener">Plugin AI WordPress con MCP abilities - mrtux.it</a> - pattern architetturale Plugin Team, base per il pattern self-hosted</li><li><a href="https://www.mrtux.it/wordpress-self-hosted-llm-locale-ollama" data-wpel-link="internal" target="_self" rel="noopener">WordPress self-hosted LLM locale Ollama - mrtux.it</a> - approfondimento Ollama + WP 7.0</li><li><a href="https://www.mrtux.it/wordpress-ai-bridge-layer-plugin-2026" data-wpel-link="internal" target="_self" rel="noopener">WordPress AI Bridge layer - mrtux.it</a> - bridge layer production-ready lato plugin</li></ul>
]]></content:encoded>
					
					<wfw:commentRss>https://www.mrtux.it/stack-ai-agent-wordpress-self-hosted-2026/feed</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
