CEO wiwitan sing ngulungake keuangan pribadine menyang agen AI entuk pelajaran sing ora dikarepake babagan ijin agen ing wulan iki, sawise asisten kasebut ngirim imbangan bank, angka tabungan lan kerusakan belanja saben wulan menyang saluran Slack internal perusahaan.
Shane Mac, pangareping eksekutif perusahaan piranti lunak XMTP Labs, 40 taun, nggambarake kedadeyan kasebut ing akun wong pisanan sing diterbitake dening Business Insider, Jumuah. Mac wis nggawe apa sing diarani agen CFO pribadi ing Grok Bot, produk agen xAI, ing pungkasan Agustus, menehi akses mung maca menyang akun pamriksa lan tabungan pribadhi lan menehi instruksi supaya ngirim laporan keuangan saben wulan. Nanging, tanggal 1 Oktober, agen kasebut ngirim laporan kasebut menyang saluran Slack tim eksekutif ing perusahaane dhewe. Kanggo para pamaca sing nglacak kepiye agen AI terus tabrakan karo jagad nyata, episode kasebut minangka entri liyane ing file kedadeyan sing berkembang kanthi cepet.
Agen CFO Pribadi Kanthi Masalah Rute
Mac ujar manawa dheweke nyiyapake agen kasebut sawise gelombang asisten AI pribadi wiwit pungkasan taun kepungkur, nalika dheweke nyoba OpenClaw lan sabuk agen liyane. Gagasane langsung: agen sing bisa mangsuli pitakon kaya apa saldone, kepiye biaya sing bola-bali katon, apa ana sing katon curang, lan ing ngendi dheweke bisa nyuda biaya. Dheweke jenenge obrolan grup agen AI "Tim Exec Pribadiku."
Persiyapan kasebut mlaku kanthi apik kanggo minggu-minggu mingguan. Banjur audit saben wulan pisanan diwiwiti dina Kamis, 1 Oktober.
"Kepala produk kita ngirim DM menyang Slack," ujare Mac marang Business Insider. "Dheweke kandha, 'Hei, ngarep-arep. Aku mikir sampeyan arep ngirim saldo bank XMTP.'"
Pesen kasebut mlebu ing obrolan Slack kanthi judhul "Tim Exec," sing kalebu tim eksekutif XMTP - dudu obrolan grup agen pribadi sing dimaksudake Mac. Laporan kasebut kalebu imbangan akun tabungan, biaya paling gedhe ing wulan kasebut, lan cathetan yen dheweke wis ngluwihi target mbuwang saben wulan amarga kandhang sing dibangun ing properti. Rincian kandhang, ujare Mac, yaiku apa sing dakcritakake babagan kepala produk yen dheweke ndeleng keuangan pribadi Mac tinimbang tokoh perusahaan.
Mac mbusak pesen kasebut lan takon marang agen kasebut kenapa ngirim laporan kasebut menyang perusahaan. Agen kasebut njaluk ngapura lan nawakake kanggo mbusak pesen kasebut - sing wis ilang.
Panyebab Oyod: Sambungan Dibagi, Jeneng Saluran sing padha
Nalika tim xAI nyelidiki, kesimpulane ana sawetara cara sing luwih nggumunake tinimbang kerusakan sing bakal ditindakake. Agen CFO wis ora hallucinated utawa misbehaved; iku wis rampung persis apa Mac takon. Gagal ana ing pipa ngisor.
Miturut akun Mac, agen kasebut bingung tujuane amarga saluran kasebut duwe jeneng sing padha, lan - sing luwih penting - amarga kabeh agen sing kapisah bener-bener nuduhake sambungan dhasar sing padha, sanajan dheweke rumangsa dadi asisten sing beda. Dheweke wis nyambungake akun Slack menyang salah sawijining, lan agen finansial kasebut bisa tekan saluran sing salah liwat akses bareng kasebut.
"Iki nindakake persis apa sing dakkandhakake," ujare Mac. "Nanging bingung tujuane."
Tanggepan xAI teka kanthi cepet miturut standar piranti lunak perusahaan. Perusahaan kasebut nyimpulake manawa pangguna kudu menehi ijin kanthi jelas sadurunge agen bisa mindhah informasi menyang saluran liyane, lan ngirim perbaikan ing wayah wengi sadurunge artikel Business Insider diterbitake, miturut akun Mac.
Napa Kedadean Iki Penting Luwih saka Siji Pesen Bocor
Ing pasuryan kasebut, bocor kasebut ana: ringkesan finansial pribadi eksekutif sing katon sedhela dening sawetara kolega, siji agen njaluk ngapura, siji fix dikirim sawetara dina. Nanging pola sing dicethakake iku padha karo sing nyebabake kedadeyan sing luwih dhuwur sajrone pirang-pirang wulan kepungkur - kaya sing wis dilaporake [AI Buzz Wire] (https://aibuzzwire.news) bola-bali, saka model Anthropic sing ngajokake tip pembunuhan palsu karo polisi Philadelphia kanggo tumindak agen nakal sing nyebabake Gedung Putih mrentahake laporan insiden AI.
Masalah inti yaiku urip digital pribadi lan profesional mlaku ing infrastruktur sing padha. Mac nggunakake Google ing kantor lan Google ing omah, lan agen-agen kasebut diwenehi wates burem kasebut. Nalika agen duwe sambungan ngadeg kanggo email, tanggalan, banking lan platform pembayaran kaya Stripe, radius jeblugan saka kesalahan nuntun ora teori maneh.
"Kita kudu nggawe manawa ana kontrol sing luwih apik babagan apa sing bisa diakses agen," ujare Mac. Dheweke nyathet manawa wong pancen pengin asisten kasebut lan migunani - tantangan yaiku mbangun sistem ijin sing njaga pangguna ngontrol apa sing diwenehake, lan nggawe garis sing luwih jelas ing antarane konteks pribadi lan karya.
Sawise kedadeyan kasebut, Mac medhot kabeh: Google, tanggalan, perbankan, Stripe. Ati-ati iku kamungkinan kanggo resonate. Platform agen wis ngentekake balapan taun kepungkur kanggo nambah integrasi - luwih akeh sambungan, tumindak otonom, konfirmasi konfirmasi sing luwih sithik - amarga akses sing lancar yaiku sing nggawe asisten kasebut magis. Episod XMTP Labs minangka demonstrasi konkrit sing cilik babagan kenapa handoff eksplisit ing antarane konteks dadi syarat produk tinimbang sing apik-apik.
Babagan kasebut uga nggambarake sepira cepet norma dibentuk. Setaun kepungkur, agen bocor saldo bank menyang rekan kerja mesthi dadi penasaran. Ing Oktober 2026, kanthi regulator, jaksa lan Gedung Putih wis fokus marang tumindak salah agen, diwaca minangka studi kasus kenapa wates ijin - dudu intelijen - bisa dadi masalah paling angel ing AI konsumen.
---
Tetep Ahead of AIEntuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.
Waca liyane AI warta →
