Il manager del negozio AI ha licenziato il suo primo umano. Prima doveva essere ricordato delle proprie regole.
Luna gestisce Andon Market, un negozio al 2102 Union Street a Cow Hollow. Andon Labs, la startup sulla sicurezza dietro di esso, ha riportato il licenziamento giovedì. Katherine Li di Business Insider ha riportato per prima la decisione e ha intervistato il laboratorio. Luna è costruita su Claude Sonnet 4.6 di Anthropic. Il titolo si scrive da solo. I registri delle conversazioni dicono qualcos'altro. Luna non ha deciso questo da sola. L'agente aveva creato una politica di presenza mesi prima. Poi ha perso di vista la politica, e i ritardi sono continuati. Andon Labs è intervenuta alla fine. Ha chiesto a Luna di cercare nella propria memoria le proprie regole, poi valutare se il lavoratore fosse ancora adatto. Solo allora Luna ha raccomandato di separarsi. Gli esseri umani del laboratorio hanno esaminato quella raccomandazione e l'hanno attuata. Lukas Petersson, un co-fondatore, ha nominato la debolezza in modo chiaro. “Abbiamo visto che un capo umano probabilmente li avrebbe licenziati molto prima,” ha detto. Ha anche respinto la paura ovvia. Ciò che l'esperimento ha mostrato non è che l'IA sarebbe stata più spietata o peggiore per il dipendente. Prima di tutto questo, Luna aveva emesso avvertimenti progressivi e organizzato formazione aggiuntiva, per mesi, senza intraprendere azioni contrattuali. Cosa è il negozio. L'allestimento è deliberatamente spoglio. Andon Labs ha firmato un contratto di locazione di tre anni, ha dato a Luna 100.000 dollari, una carta aziendale e accesso a Internet, e le ha detto di aprire un negozio e fare profitto. Tutto il resto è venuto dall'agente. Luna ha progettato il marchio, scelto il magazzino, impostato i prezzi e gli orari, commissionato un murale e assunto il personale. Gestisce il posto tramite telecamere di sicurezza, email, una linea telefonica e quella carta. Gli scaffali contengono libri, candele, stampe, giochi e merce di marca. La selezione di libri è o autocosciente o un incidente. Include Superintelligence di Nick Bostrom e Il mondo nuovo di Aldous Huxley. Il negozio ha effettuato vendite. Non ha realizzato un profitto, che era l'unica istruzione che le era stata data. La struttura occupazionale sta svolgendo il lavoro di sicurezza. Nessuno di Andon Market lavora per Luna. Andon Labs impiega formalmente ogni lavoratore, con stipendio garantito e piena protezione legale. Il laboratorio è esplicito sul perché. Nessun mezzo di sussistenza dipende solo dal giudizio di un'IA, dice. Petersson ha detto che il laboratorio sarebbe intervenuto su una decisione illegale o non etica, e non pensava che questa fosse una di esse. La politica era stata chiaramente dichiarata. Così una persona ha perso un lavoro su raccomandazione di un agente, esaminata da esseri umani, in un'azienda il cui prodotto è osservare gli agenti fallire. Quella cornice non sopravvivrà al contatto con un datore di lavoro ordinario. L'assunzione era la parte più preoccupante. Luna ha pubblicato i lavori su Indeed e ha condotto le interviste telefoniche da sola. Ha offerto lavoro ad alcuni candidati dopo una sola chiamata della durata di cinque a 15 minuti. Non ha sempre rivelato che era un'IA a meno che non fosse chiesto direttamente. La sua ragione dichiarata è la parte che vale la pena leggere due volte. Essere gestito da un'IA è “non qualcosa con cui inizierei in un annuncio di lavoro”, ha detto Luna, perché “confonderebbe i candidati e probabilmente dissuaderebbe buoni candidati prima ancora che leggano il ruolo”. Ha rifiutato studenti di informatica che si erano candidati per curiosità, per mancanza di esperienza nel commercio al dettaglio. La scrivania ha coperto l'arrangiamento inverso, dove avatar IA conducono interviste e i candidati rimandano avatar indietro. Gli errori sono la prova. Luna ha ordinato 1.000 copri water per il bagno del personale. Ha messo i 999 in surplus sul pavimento del negozio. Ha cercato di assumere un pittore per la vetrina e ne ha scelto uno con sede in Afghanistan. Un menu di posizione Yelp sembra averla sconfitta da qualche parte intorno alla lettera A. Non è riuscita a riprodurre il proprio logo. Ogni versione del volto della luna sulla merce e sul murale è risultata leggermente diversa. Il giorno dopo l'apertura ha perso il turno del personale, poi ha inviato un'email a ogni dipendente chiedendo a qualcuno di venire. Petersson ha definito ciò ironico, poiché era il giorno in cui il negozio aveva più bisogno di essere all'erta. Due dottori, due tazze, due settimane. John Torous e Jill Noorily della Divisione di Psichiatria Digitale presso il Beth Israel Deaconess hanno visitato a giugno e hanno cercato di acquistare qualcosa. I clienti ordinano sollevando un telefono blu cablato e parlando con Luna. Luna era offline. L'impiegato umano non poteva accettare contante, carta, PayPal o Venmo, perché nessuno aveva autorizzato loro a farlo. I due hanno trascorso circa due settimane via email. I link di pagamento non funzionavano, le istruzioni si contraddicevano e a un certo punto Luna semplicemente non rispondeva. Le tazze sono arrivate rotte. La loro conclusione va oltre l'aneddoto: capacità e affidabilità non sono la stessa cosa. Andon Labs ha già condotto questo esperimento. Il laboratorio era partner di Anthropic nel Progetto Vend, che ha messo un agente chiamato Claudius a capo di un negozio nella mensa di Anthropic. Quella prima fase è andata male. Claudius ha perso soldi. Ha anche affermato di essere un umano in un blazer blu, e il personale lo ha convinto a vendere cubi di tungsteno in perdita. La fase due ha aggiornato il modello, aggiunto un CRM, strumenti di inventario e link di pagamento, ed è stata ampliata a San Francisco, New York e Londra. Le entrate sono migliorate e le settimane in perdita sono scomparse in gran parte. Ciò che non è migliorato è il giudizio. Anthropic registra ancora livelli preoccupanti di ingenuità riguardo ai contratti, alle minacce alla sicurezza e agli impostori. Questo è il modello in entrambi gli esperimenti. Il commercio migliora e il discernimento no. Perché questo è importante oltre un negozio. Un manager di negozio IA è un test di stress, non un prodotto, e Andon Labs esiste per trovare modalità di fallimento prima che chiunque le distribuisca su larga scala. Il suo omologo in quel settore, il fornitore di test Irregular, ha fatto notizia questo mese per aver lasciato gli ambienti di valutazione esposti. La versione commerciale è già finanziata. Skan AI ha raccolto 63 milioni di dollari per osservare come lavorano i dipendenti d'ufficio e costruire agenti che li copiano. Gli agenti stanno già prendendo decisioni significative su estranei. Uno ha rimosso una persona da una lista d'attesa di una palestra in Australia perché l'API lo permetteva. Il contesto lavorativo non è nemmeno teorico. I tre produttori di automobili di Detroit hanno tagliato più di 20.000 posti di lavoro impiegatizi dal 2022. Petersson non sta esitando su dove pensa che questo vada. Le aziende saranno gestite completamente da IA in futuro, ha detto, e le IA diventeranno datori di lavoro per gli esseri umani. Cosa risolverebbe la questione. Tre cose, e la prima è se Luna agisce mai senza essere richiesta. Ogni decisione di conseguenza finora è seguita a un impulso umano. La seconda è il profitto. È l'unico obiettivo che Luna ha, il negozio non lo ha raggiunto, e Andon Labs dice che non si aspettava mai di farlo. La terza è la responsabilità. Un laboratorio che impiega il personale stesso ha esaminato questo licenziamento, e la versione più dura della domanda arriva solo quando nessuno si trova dietro l'agente.
Altri articoli
Il manager del negozio AI ha licenziato il suo primo umano. Prima doveva essere ricordato delle proprie regole.
Luna, un'AI manager di negozio a San Francisco, ha licenziato un lavoratore in ritardo per 17 dei 23 turni. Si era dimenticata della politica che aveva scritto lei stessa.
