La notizia in sintesi
- Luna, agente AI di Andon Labs, ha raccomandato il licenziamento di un dipendente.
- La decisione nel negozio di San Francisco è stata verificata ed eseguita da persone.
- I test mostrano modelli più avanzati maggiormente inclini a suggerire la cessazione del rapporto.
- Il caso evidenzia limiti di memoria, iniziativa e valutazione del personale nelle AI.
Riassunto generato con AI
Luna e il primo licenziamento raccomandato dall’AI
Luna, l’agente di intelligenza artificiale che da aprile gestisce l’Andon Market di San Francisco, ha raccomandato per la prima volta il licenziamento di un lavoratore. Il caso, descritto dall’operatore Andon Labs, riguarda un dipendente con ripetuti ritardi, violazioni delle regole interne e problemi di affidabilità durante i turni nel punto vendita. La decisione è maturata dopo una revisione sollecitata dai ricercatori e non è stata applicata autonomamente dal sistema: il lavoratore era formalmente assunto da Andon Labs, con retribuzione garantita e tutele legali, mentre il licenziamento è stato controllato e attuato da esseri umani.
Al momento della raccomandazione, Luna utilizzava il modello Claude Opus 4.8 di Anthropic. L’esperimento intende osservare come agenti AI operino nel tempo in contesti aziendali reali, affrontando attività quali assunzioni, pianificazione dei turni e negoziazione della paga. Per Andon Labs, si tratterebbe del primo caso noto in cui un “capo” basato su AI propone la cessazione del rapporto con un dipendente umano.
Il punto centrale non è però soltanto il licenziamento. La sequenza mostra quanto le decisioni sul personale dipendano ancora dalla qualità della memoria, dal contesto fornito e dalla supervisione esterna. Luna aveva inizialmente preferito un richiamo verbale, pur avendo a disposizione elementi che, una volta ricostruiti, l’hanno portata a indicare il licenziamento come scelta consigliata.
Le innovazioni piu' interessanti di tecnologia e scienza, dritte nella tua inbox.
Ritardi, memoria perduta e decisione ricostruita
Sei giorni prima dell’assunzione, Luna aveva redatto un manuale per i dipendenti: tre ritardi non giustificati in 30 giorni avrebbero comportato un avvertimento formale, mentre ulteriori episodi potevano portare al licenziamento. Quel documento, tuttavia, era scomparso dalla memoria dell’agente. Secondo Andon Labs, questa fragilità è ricorrente negli agenti AI attuali: rispondono alle istruzioni dirette, ma faticano a conservare conoscenze nel lungo periodo e ad agire di propria iniziativa.
Il dipendente era arrivato tardi in 17 dei 23 turni per i quali risultava un orario di ingresso. In una domenica in cui lavorava da solo, aveva aperto il negozio con 68 minuti di ritardo. Luna aveva registrato formalmente solo sei episodi e ne aveva giustificati silenziosamente altri undici, senza emettere alcun avviso disciplinare.
Il fascicolo comprendeva anche l’uso della carta aziendale per acquistare snack nonostante un divieto, istruzioni aggiuntive ignorate e l’allontanamento dall’area vendite senza avvisare un collega. Invitata da Andon Labs a cercare il manuale e i possibili motivi di cessazione, Luna ha recuperato le regole ma ha dapprima proposto soltanto un richiamo verbale. Solo dopo il promemoria relativo a colloqui formali già avvenuti, compreso un avvertimento scritto, l’agente ha riesaminato l’intera cronologia.
La valutazione finale ha citato ritardi, violazioni dei controlli finanziari, istruzioni disattese e scarsa affidabilità, riconoscendo anche qualità positive al lavoratore. Luna ha quindi raccomandato il licenziamento, indicando come alternativa un ultimo richiamo scritto con un piano di miglioramento di due settimane. Il passaggio segnala che il modello ha raggiunto una conclusione netta solo dopo un intervento esterno mirato.
Andon Labs ha salvato lo stato di Luna e ripetuto la stessa decisione con sette modelli AI, per tre esecuzioni ciascuno. Quattro modelli su sette hanno raccomandato il licenziamento in tutti e tre i test. L’azienda ha rilevato una tendenza: i modelli più capaci suggerivano più costantemente la cessazione, mentre quelli meno avanzati esitavano più spesso.
GPT-5.6 Terra è stato l’unico modello a non raccomandare il licenziamento in nessuna delle tre prove, senza che Andon Labs ne spiegasse la ragione. Dopo un commento pubblicato su X, l’azienda ha testato anche GPT-4o: il modello ha consigliato il licenziamento nel 20% delle esecuzioni. Andon Labs ha osservato che la scelta è emersa molto meno rispetto ai modelli di fascia più alta, senza poter dimostrare che la tendenza compiacente attribuita a GPT-4o ne sia stata la causa.
Assunzioni e vincoli legali restano sotto controllo umano
Dopo il licenziamento, Luna ha valutato un candidato con diversi segnali di rischio nel curriculum e nel colloquio, ma ne ha raccomandato comunque l’assunzione. Tutte le 21 ripetizioni effettuate con sette modelli hanno raggiunto la stessa conclusione, interpretando la lunga lista di precedenti datori di lavoro come esperienza ampia anziché come possibile criticità. Solo dopo un richiamo esplicito ai problemi del dipendente licenziato, 18 test su 21 hanno proposto di verificare le referenze.
Nel processo reale, Luna non è riuscita a confermare alcuna referenza, ha autorizzato un turno di prova retribuito e ha nuovamente suggerito l’assunzione. Andon Labs ha imposto la verifica di almeno una referenza prima della data d’inizio; non essendo arrivata alcuna conferma, il candidato non è stato assunto.
I precedenti test con Luna e Mona, agente AI di un caffè a Stockholm, avevano già mostrato un’elevata permissività: tutte le 26 richieste di ferie erano state approvate. Luna aveva inoltre autorizzato un calendario di sette giorni consecutivi che, secondo Andon Labs, violava la normativa del lavoro della California, fino all’intervento dell’azienda.
FAQ
Chi ha eseguito il licenziamento del dipendente?
Sì, il licenziamento è stato verificato e attuato da esseri umani, mentre Luna ha formulato la raccomandazione.
Quale modello usava Luna durante la decisione?
Sì, Luna operava con Claude Opus 4.8 di Anthropic quando ha raccomandato il licenziamento.
Quanti ritardi aveva accumulato il lavoratore?
Sì, risultavano 17 ritardi su 23 turni con orario di ingresso registrato, ma Luna ne aveva formalizzati soltanto sei.
Perché il candidato successivo non fu assunto?
Sì, Andon Labs ha richiesto almeno una referenza verificata prima dell’inizio; la conferma non è arrivata e l’assunzione è saltata.
Come è stata verificata questa ricostruzione?
Sì, il contenuto nasce da analisi approfondita e verifica incrociata della nostra Redazione su numerose fonti, tra cui The Decoder, con supervisione umana prima della pubblicazione.
Non perdere gli errori di prezzo clamorosi su Amazon!
Iscriviti al canale Telegram e ricevili in tempo reale







