Cervello sovrano · zero token verso fornitori esterni

Il cervello sovrano delle persone digitali,
istruibile sui tuoi documenti.

Un modello piccolo e veloce, con pesi aperti a licenza commerciale, sul ferro nostro. Si misura contro i leader e si istruisce su ciò che serve a te — senza che un testo lasci la macchina.

Cos’è

AgileLLM è il cervello sovrano delle persone digitali: un modello piccolo e veloce, con pesi aperti a licenza commerciale, sul ferro nostro e zero token verso fornitori esterni. Si istruisce sui tuoi documenti e si misura contro i leader, senza che un solo testo lasci la nostra macchina.

Per chi

I numeri, contro i leader

Ogni numero viene dal banco a due bracci (banco/risultati/cervello/CONFRONTO.json), con la macchina e la data accanto; i tempi si confrontano solo sulla stessa macchina. Un braccio non misurato è scritto «non ancora misurato», mai riempito con un numero inventato.

sportello (30 domande di adp, tre persone)

RunPod RTX 4090, 17/9/2026, llama-server b11005 -np auto; Mistral via API dal pod

braccioprimo token med · p95prima frase med · p95intera med · p95token/sa temalimitirifiuticosto nostro · $/1.000 token di risposta
agilellm-1.5b
qwen2.5-1.5b-instruct-q4_k_m
24 · 44 ms76 · 121 ms103 · 225 ms42521/309/1050.0006376695048880478
agilellm-7b
qwen2.5-7b-instruct-q4_k_m
70 · 112 ms170 · 331 ms280 · 427 ms16927/3010/1040.001571895424836601
mistral
mistral-small-latest
356 · 622 ms472 · 1409 ms605 · 1450 ms11026/309/1000.004258382180539273
claudenon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
gptnon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
groknon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
llamanon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato

help-online (200 domande, v2, scheda in contesto)

NVIDIA GeForce RTX 4090, 24564 MiB, host c6ce4200d8c9, 2026-09-25, software 83f1e4d

braccioprimo token med · p95prima frase med · p95intera med · p95token/sa temalimitirifiuticosto nostro · $/1.000 token di risposta
agilellm-7b
qwen2.5-7b-instruct-q4_k_m
19 · 52 ms145 · 273 ms257 · 554 ms164137/20036/3720.001400749483583388
agilellm-7b-lora
7b-lora-help-online-q4_k_m
19 · 50 ms144 · 306 ms266 · 522 ms158156/20037/3710.0014550853869433637
mistral
mistral-small-latest
381 · 599 ms545 · 983 ms725 · 1365 ms133184/20037/3720.010088051934398653
claudenon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
gptnon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
groknon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato
llamanon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misuratonon ancora misurato

Il costo è il costo nostro misurato dal banco (make costo), non un prezzo di vendita: il prezzo è una decisione del titolare, si chiede un preventivo.

Istruibile sui tuoi documenti

Ogni pacchetto di conoscenza ha il suo metro di domande: il modello si istruisce sui documenti del dominio e il banco misura quanto li ha letti e capiti. A che punto è ogni metro:

Gli altri domini (GIS/paghe, normativa TRPG, NIS2, tributi) sono censiti in docs/PROVENIENZA.md come materia prima; il loro metro di domande non è ancora costruito: non ancora misurato.

API

Una rotta OpenAI-compatibile, una chiave per prodotto e per tenant, streaming a frase, misura d’uso. Base: https://api.agilellm.agile.software/v1 · autenticazione Authorization: Bearer <chiave>.

B=https://api.agilellm.agile.software; K=all_…
curl -s -X POST $B/v1/chat/completions -H "Authorization: Bearer $K" \
  -H 'Content-Type: application/json' -d '{
  "model": "agilellm", "stream": true, "max_tokens": 120,
  "messages": [{"role": "user", "content": "Quando siete aperti?"}]}'
from openai import OpenAI
c = OpenAI(api_key="all_…", base_url="https://api.agilellm.agile.software/v1")
for pezzo in c.chat.completions.create(model="agilellm", stream=True, extra_body={"a_frase": True},
        messages=[{"role": "user", "content": "Quando siete aperti?"}]):
    print(pezzo.choices[0].delta.content or "", end="")

La documentazione completa (endpoint, errori, streaming a frase, ripiego dichiarato): Documentazione dell’API.

Sovranità

Ogni peso ha la sua riga con licenza commerciale verificata alla fonte in docs/PROVENIENZA.md; i dati di istruzione sono solo nostri o con diritto d’uso; nessun ripiego silenzioso verso un fornitore esterno (obiettivo 12). L’audit di sovranità (make audit) corre a ogni consegna: docs/AUDIT-SOVRANITA.md.

Come si compra

AgileLLM è un organo à la carte: si compra anche da solo, con una rotta OpenAI-compatibile, una chiave per prodotto e per tenant, streaming a frase e misura d’uso. Non c’è un listino di vendita deciso dal titolare: il prezzo è una decisione, non un numero. Per una chiave o un preventivo, chiedi al serverino (la regia) indicando il caso d’uso e il volume stimato.