Recuperato o Integrale: scegli tu come passare il contesto. Dal menu ▸: «Recuperato» (il Reminder più i brani che somigliano al messaggio: poche migliaia di token, stabile) o «Integrale» (i moduli e le fonti interi, tutti o solo quelli spuntati, nello stesso ordine a ogni turno: è quello che fa scattare la cache dei provider). Un modulo cifrato compare col lucchetto e resta fuori.
Il termometro del contesto, prima di inviare. «Contesto 12,4k token · 31 % della finestra», verde sotto il 50 %, giallo fino all’80 % («la conversazione verrà accorciata presto»), rosso oltre («resta poco spazio per la risposta») con il tasto «Passa a Recuperato»; oltre il 100 % l’invio non parte. In Integrale dice quanto manda ogni messaggio, e coi crediti quanto costa (con e senza cache). Quando la cronologia viene tagliata, una riga nel filo lo dice.
Lo sforzo del modello, per motore. Un chip «Sforzo» nella barra sotto la casella, solo dove il motore lo supporta: Anthropic (pensiero adattivo e livello low·medium·high·max; su Haiku il budget), OpenAI (reasoning_effort). DeepSeek e crediti hanno «Pensa prima»; sul telefono niente. Le finestre: 8 192 token in Recuperato, quella del modello in Integrale (fino a 131 072); i modelli sconosciuti valgono 32 768.
Le conversazioni in `chat/`, con una cartella per progetto. Le nuove nascono in IllAIra/chat (o chat/<progetto>); il pannello ≡ elenca tutte le conversazioni, raggruppate per progetto e poi le libere, e ogni riga dice chi era integrato. Le vecchie restano in chat history, leggibili dov’erano: nessuna copia silenziosa.
I Progetti: fonti e istruzioni per le chat che vuoi. Dalla Dashboard, «Progetti»: ne crei uno, gli dai istruzioni (entrano nel prompt dopo le tue istruzioni generali, prima del profilo) e fonti — file .md, .txt e PDF, il cui testo si estrae quando lo aggiungi e resta sul telefono — o moduli dei tuoi profili, per riferimento. «Indicizza adesso» li mette nella ricerca per significato con l’embedder del telefono. Tutto vive in projects/ nella cartella IllAIra.
In chat: «Collega un progetto». Dal tasto ▸ accanto alla casella: il chip «Progetto: …» sopra la casella, e il modello legge anche le fonti del progetto — anche senza profilo integrato (allora entrano come «Fonti del progetto»). Un progetto cancellato non tocca nessun profilo: le chat restano, scollegate.
Gli Specialisti: la stessa IA, solo alcuni moduli. Nella Sferografia, «Componi specialista»: un tocco su un nodo lo accende o lo spegne con i suoi figli, la striscia in alto conta i moduli accesi, «Salva come specialista» gli dà un nome. A disco è un file piccolo di soli riferimenti (specialists/ nel profilo), non una copia: se un modulo cambia, lo specialista lo vede cambiato; un modulo nuovo entra spento. Cancellarlo non tocca nessun modulo.
In chat: «Integrazione profilo IllAIra». Al posto di Chat / File focus, un chip in testata sceglie chi entra nel prompt: nessuno, il profilo intero, uno specialista — anche di un altro profilo. Si cambia anche a metà conversazione, e il cambio resta scritto nel filo. Con uno specialista il modello vede solo i suoi moduli; il Reminder c’è sempre.
Il reminder nel prompt è chi è la IA. Non più i primi caratteri del file, ma il titolo, le regole, il registro e i nuclei: i moduli entrano come brani recuperati, mai per sbaglio.
La chat ha un prompt di sistema a strati, e lo puoi leggere. Prima le regole di IllAIra (scritte dalla casa, scaricate all’avvio dell’app e mai durante una conversazione), poi la cornice tecnica, poi le tue istruzioni per tutte le chat, poi il profilo. L’ordine non cambia mai: è quello che fa scattare la cache dei provider, e con Anthropic il prefisso stabile viaggia già in un blocco a parte.
Istruzioni per tutte le chat. In Impostazioni › Chat con la tua IA scrivi come vuoi che il modello risponda (tono, lingua, cosa evitare): entrano in ogni chat, dopo le regole di IllAIra e prima del profilo, e restano tue in chat/instructions.md nella cartella IllAIra. Sotto, le regole di IllAIra in sola lettura, con versione e data.
L’ingranaggio in chat. Cosa mostrare nel filo — il saldo dei crediti (solo col motore a crediti), i token per messaggio, i token della sessione — e «Vedi il prompt di sistema»: il testo esatto che il modello riceve, strato per strato, con l’origine di ciascuno. Niente di nascosto.