lunedì 5 ottobre 2026

[AI] - Codex - COMPUTER USE E DESKTOP REMOTO: Configurare l'AI per lavorare sotto controllo

Un assistente AI che spiega dove cliccare è utile.

Un assistente che può osservare un’applicazione, leggere un errore e interagire con la sua interfaccia offre possibilità ulteriori, ma richiede anche maggiore attenzione.

La configurazione non riguarda soltanto l’abilitazione di un componente. Occorre stabilire quale ambiente l’AI può utilizzare, quali operazioni sono autorizzate e come verificare il risultato.

In questo articolo vediamo un caso concreto:

Codex sul computer locale, una sessione di Desktop remoto e un browser aperto sulla macchina remota, utilizzato per lavorare con Oracle Data Transforms.

1. LA CONFIGURAZIONE CHE VOGLIAMO OTTENERE

Nella prova da cui nasce questo articolo, il percorso operativo è stato questo:

Computer locale Windows
        |
        v
Codex con Computer Use
        |
        v
Finestra di Connessione Desktop remoto
        |
        v
Browser sulla macchina remota
        |
        v
Oracle Data Transforms

L’assistente ha potuto osservare il contenuto della finestra remota e interagire con l’interfaccia: aprire dettagli, scorrere elenchi e leggere messaggi di errore.
Questo non equivale a una connessione diretta al database.
L’AI utilizza la sessione grafica già aperta dall’operatore.
Non abbiamo utilizzato Zoom e non è stato necessario condividere lo schermo attraverso una videoconferenza.
Questa è una verifica relativa alla configurazione provata, non una garanzia di compatibilità con qualsiasi ambiente remoto.

2. ABILITARE COMPUTER USE

La documentazione OpenAI indica la disponibilità di Computer Use nell’app desktop, su Windows e macOS, nelle regioni supportate e secondo le abilitazioni dell’ambiente.
Il percorso di configurazione documentato è:
1. Aprire l’app desktop e selezionare Codex oppure   ChatGPT Work.
2. Aprire Plugins → Computer Use.
3. Installare o abilitare il plugin, secondo quanto mostrato.
4. Verificare che siano attivi il server e la relativa skill.
5. Aprire Settings → Computer use e controllare gli accessi alle applicazioni.

Gli amministratori possono imporre restrizioni. Il permesso di utilizzare un’applicazione resta distinto
dall’autorizzazione a compiere una specifica operazione.
Non conviene quindi interpretare un’opzione come “consenti sempre” come un mandato generale a modificare tutto ciò che appare sullo schermo.

La domanda tecnica è:
“L’assistente può accedere a questa applicazione?”

La domanda operativa è diversa:
“Che cosa gli abbiamo autorizzato a fare al suo interno?”

3. PREPARARE LA SESSIONE REMOTA

Su Windows, Computer Use opera sul desktop attivo e mouse e tastiera in primo piano.
La documentazione raccomanda di mantenere visibile l’applicazione e di evitare attività concorrenti
sulla stessa interfaccia.
Per il nostro scenario, propongo questa preparazione:
- L’operatore apre Desktop remoto e completa personalmente   l’autenticazione.
- Sulla macchina remota apre il browser e accede   all’applicazione.
- Porta in evidenza la pagina interessata.
- Comunica all’assistente quale finestra utilizzare.
- Durante le azioni dell’assistente evita di spostare contemporaneamente mouse, finestre e selezioni.

Bisogna anche distinguere il browser locale da quello remoto. Nella configurazione provata, il browser Oracle era dentro la finestra di Desktop remoto: il controllo avveniva attraverso quella finestra, non attraverso un collegamento diretto al browser.
Dire soltanto “usa Chrome” sarebbe stato ambiguo.
Una richiesta iniziale più precisa è:
  1.     Usa Computer Use sulla finestra di Connessione Desktop remoto.
  2.     L’applicazione interessata è Oracle Data Transforms, aperta nel browser della macchina remota.
  3.     Per ora descrivi soltanto la schermata visibile.
  4.     Non cliccare e non digitare.
Questo primo controllo serve a verificare che utente e assistente stiano parlando dello stesso ambiente.

4. RENDERE PERSISTENTI LE REGOLE DI COMPORTAMENTO

Codex può leggere istruzioni persistenti da file AGENTS.md.
La configurazione prevede istruzioni globali e istruzioni specifiche del progetto.
Il percorso globale predefinito è nella directory .codex dell’utente, salvo configurazioni differenti.
Su Windows, normalmente:

    C:\Users\<utente>\.codex\AGENTS.md

Occorre verificare quali istruzioni siano effettivamente caricate: esistono precedenze, file di override e limiti di dimensione.
Un file molto lungo non è automaticamente una configurazione migliore.
Per un utilizzo guidato, una regola proposta potrebbe essere:

  UTILIZZO GUIDATO DI COMPUTER USE
    Prima di interagire con un’applicazione, identifica la finestra e chiedi all’utente quale operazione eseguire. Esegui soltanto il passo autorizzato, verifica il risultato e fermati in attesa della successiva indicazione.
    Non effettuare autonomamente salvataggi, esecuzioni, importazioni, cancellazioni o modifiche.
    Se l’utente autorizza esplicitamente una sequenza delimitata, completala soltanto entro il perimetro  indicato. 
    In caso di errore, finestra diversa, risultato inatteso o richiesta di autenticazione, fermati e informa l’utente. Alla richiesta “fermati”, interrompi le ulteriori azioni.

Questa è una proposta di istruzioni operative, non una funzione di sicurezza aggiuntiva.
AGENTS.md orienta il comportamento dell’assistente;
non revoca i privilegi dell’account utilizzato.

OpenAI raccomanda di affiancare le istruzioni a controlli tecnici che ne facciano rispettare le regole.
In un ambiente aziendale, questo significa valutare anche account dedicati, privilegi limitati e ambienti
di prova.
Scrivere “non modificare il database” non equivale a utilizzare un account tecnicamente incapace
di modificarlo.

5. ESEMPIO: VERIFICARE UN’IMPORTAZIONE DI METADATI ORACLE

 Supponiamo di avere modificato una tabella di staging e di averne rilanciato l’importazione nel repository di Data Transforms.
La verifica richiesta riguarda una nuova colonna, chiamata nell’esempio ID_CARICAMENTO.
Non chiediamo all’AI di correggere automaticamente qualsiasi problema. Definiamo invece una sequenza precisa:

    Ti autorizzo esclusivamente a questa sequenza di verifica:
    1. Apri i dettagli del job di importazione indicato.
    2. Leggi lo stato finale.
    3. Se è terminato correttamente, apri l’entità  STG_ATTIVITA.
    4. Verifica se compare ID_CARICAMENTO e riporta il tipo.
    5. Se il job è in errore, leggi il messaggio del passo fallito.
    Non rilanciare il job.
    Non modificare l’entità.
    Non salvare.
    Non eseguire query o procedure.
    Alla fine riferisci ciò che hai verificato e fermati.

Il risultato utile non è un generico “tutto a posto”. È un resoconto che separa le evidenze:
  •     Job controllato:    identificativo e nome.
  •     Stato osservato:    successo oppure errore.
  •     Entità controllata:    nome esatto.
  •     Colonna:    presente, assente oppure non verificabile.
  •     Tipo osservato:    valore mostrato dall’interfaccia.
  •     Modifiche eseguite:    nessuna.
  •     Limiti della verifica:  eventuali controlli non completati.
Se il job fallisce, l’assistente deve riportare il punto di errore.
Non dovrebbe trasformare automaticamente la diagnosi in una cancellazione delle entità o in un nuovo tentativo di importazione.
Anche una verifica riuscita ha un limite: vedere la colonna nel repository conferma quel metadato, ma non dimostra che tutti i dataflow siano già aggiornati o che il caricamento dei dati funzionerà.

6. PREPARARE NON SIGNIFICA ESEGUIRE


Un secondo incarico potrebbe riguardare la preparazione di una variabile o di un dataflow.
È importante concordare il punto di arresto:

  •     Apri la configurazione e compila esclusivamente i campi concordati.
  •     Fermati prima di Salva, Convalida, Anteprima  o Esegui.
  •     Mostrami i valori inseriti e attendi la mia conferma.

La prudenza non riguarda soltanto i pulsanti evidentemente distruttivi.
Prima di utilizzare una funzione di anteprima o convalida occorre capire se comporti una semplice verifica oppure l’esecuzione di qualcosa.

La regola proposta è:
“Se non è chiaro l’effetto di un comando, prima si chiarisce il comportamento e poi si autorizza l’azione.”

7. LIMITI PRATICI: PUÒ ESSERE PIÙ LENTO DELL’OPERATORE


Nella nostra prova, la navigazione ha richiesto più passaggi di osservazione, azione e controllo.
L’utente ha poi scelto di riprendere manualmente alcune operazioni perché il procedimento risultava lento. È un limite da dichiarare. Computer Use può essere utile per leggere errori, verificare configurazioni o accompagnare un’attività poco familiare.
Non è necessariamente il mezzo più efficiente per ripetere decine di operazioni identiche.
Per attività ripetibili, la documentazione OpenAI suggerisce di preferire integrazioni strutturate, quando disponibili.
La mia raccomandazione operativa è quindi:
  • - Usare l’interfaccia per osservare e comprendere.
  • - Usare script, procedure o integrazioni documentate per le elaborazioni ripetitive.
  • - Mantenere un operatore responsabile delle autorizzazioni e delle verifiche.
Il processo consegnato dovrebbe restare eseguibile anche senza la presenza dell’assistente.

8. IL CONFINE RIGUARDA ANCHE I DATI VISIBILI


Computer Use può elaborare contenuti visibili e schermate delle applicazioni autorizzate.
Prima di utilizzarlo occorre quindi valutare quali informazioni saranno esposte e se il loro trattamento
sia consentito.
Per questo esempio sono sufficienti nomi dimostrativi e metadati tecnici.
Non servono password, indirizzi di collegamento, dati personali o contenuti aziendali estranei
alla verifica.
Il fatto che un’applicazione sia accessibile all’operatore non autorizza automaticamente a condividerne ogni contenuto con un servizio AI.

CONCLUSIONE
Configurare un assistente per utilizzare il computer richiede due lavori distinti: rendere disponibile
lo strumento e definire il metodo operativo.
  • La prima parte abilita l’interazione. 
  • La seconda stabilisce dove deve fermarsi.
Il risultato da cercare non è un assistente che clicchi autonomamente il maggior numero possibile di pulsanti, ma un collaboratore che sappia identificare l’ambiente, rispettare il perimetro e distinguere un’azione eseguita da un risultato realmente verificato.

La possibilità di agire è una capacità tecnica. 
Il diritto di agire dipende dall’autorizzazione ricevuta.

FONTI CONSULTATE

  • Documentazione ufficiale OpenAI, verificata il 5 ottobre 2026:
    • - Computer Use:  configurazione, permessi e limiti.
    • - Use your computer with ChatGPT:  utilizzo operativo e gestione delle sessioni.
    • - Custom instructions with AGENTS.md:  istruzioni persistenti.
    • - Customization:  distinzione tra istruzioni e controlli tecnici.