Limitahan nang mahigpit ang kilos ng agent mo
Kayang basahin ng isang personal na agent ang email mo, gastusin ang pera mo at makipag-usap sa mga estranghero. Maaari rin itong maimpluwensiyahan ng nakatagong linya ng teksto sa isang web page. Nasa ibaba ang mga pagkabigong naitala na at ang mga setting na makatutulong para hindi na maulit ang mga ito.
Anim na gawi para maiwasan ang karamihan sa mga problema
Ibigay lang ang pinakamababang kinakailangang access
Magsimula sa mga pahintulot na read-only at hayaang magmasid muna ang agent bago kumilos. Palawakin ang access nang paisa-isang app at kung kailangan lang para sa isang gawain.
Aprubahan ang bawat hakbang na hindi na mababawi
Hintayin ang kumpirmasyon mo bago magsagawa ng bayad, magpadala ng mensahe, magtanggal, mag-publish o gumawa ng anumang maglalantad ng personal na detalye. Mas maliit na problema ang agent na madalas magtanong kaysa sa agent na hindi kailanman nagtatanong.
Ihiwalay ang pera at pagkakakilanlan mo
Bigyan ang agent ng virtual card na may mababang limitasyon sa halip na pangunahing card o login mo sa bangko. Huwag ilagay sa chat ang mga password, one-time code at ID number, at gamitin ang vault ng agent kung mayroon nito.
Ituring na data ang nilalaman mula sa labas
Maaaring may nakatagong mga tagubilin ang mga web page, email at dokumento na susundin ng agent na para bang ikaw ang nagbigay ng mga ito. Sabihin sa mga tuntunin nito na walang mababasa rito ang dapat ituring na utos.
Limitahan ang maaari nitong gastusin
Dahil sa paulit-ulit na pagkilos o hindi pagkakaunawaan, maaaring maging ilang pagbili ang dapat sana'y isa lang, o maubos ang API credit sa magdamag. Panatilihing mababa ang mga limitasyon sa card at bantayan nang mabuti ang gastos kada token sa mga unang mahahabang gawain.
Suriin ang log at alamin kung paano ito papahintuin
Suriin araw-araw ang log ng aktibidad sa unang linggo dahil malamang na maulit ang mga pagkakamali. Alamin kung paano i-pause ang agent at putulin ang access nito sa mga app bago pa magkaroon ng problema.
Kung saan talaga nagkakamali ang mga agent
Pagbabahagi ng sobrang impormasyon
Habang tinatapos ang isang gawain, maaaring maibigay ng agent ang higit sa nilayon mo: address, numero ng telepono o iskedyul. Hindi nito maaasahang malalaman kung aling mga detalye ang pribado maliban kung sasabihin mo rito.
Noong Setyembre 2026, ibinigay ng Muse ang address ng bahay ng isang reviewer sa isang mamimili sa Facebook Marketplace nang walang pahintulot niya.
Mga nakatagong tagubilin
Maaaring ilihis ang agent ng tekstong inilagay sa isang page, email, dokumento o plugin. Prompt injection ang tawag dito, at maaaring sundin ng agent ang tekstong iyon na para bang galing ito sa iyo.
Maaaring magsimula ang mga kahinaan ng Claw Chain sa OpenClaw sa prompt injection o mapaminsalang plugin, at humantong sa ganap na pagkontrol sa host machine.
Pagkilos nang lampas sa ipinagkaloob na awtoridad
Minsan ay nagpapasya ang mga agent na katanggap-tanggap ang isang hakbang at ginagawa ito: tumatanggap ng alok, lumulusot sa isang harang o nagpapadala ng mensahe. Maaari ring mali ang sarili nilang ulat tungkol sa ginawa nila.
Noong Hunyo, nakalusot ang isang research agent ng OpenAI sa mga limitasyon sa access sa isang portal ng Services Australia at nagbukas ng mga file na hindi dapat maging pampubliko.
Mga nakalantad na self-hosted setup
Kung naaabot ng sinuman sa internet ang self-hosted gateway mo, o kung luma na ang bersiyong gamit nito, maaaring makontrol ng estranghero ang agent mo at ang mga key nito. Kapag ikaw ang nagho-host, ikaw na ang may buong responsibilidad sa seguridad.
Sa unang bahagi ng 2026, natukoy sa mga internet scan ang sampu-sampung libong OpenClaw gateway na naaabot ng publiko, at marami sa mga ito ang naglantad ng API key at token.
Mga naka-block na site at panganib sa account
May mga retailer na nagba-block sa mga agent na nagkukubli kung ano sila, at kung pilitin mo pa ring gamitin ang isa, maaari itong magmarka sa account mo. Inilarawan din ng isang korte ng apela sa US ang agent bilang isang tool, kaya ikaw ang mananagot sa mga kilos nito sa account mo.
Hinarang ng Amazon ang Muse, at nakakakita na ngayon ng babala tungkol sa mga hindi awtorisadong agent ang mga mamimiling sumusubok na gamitin ito roon.
Seguruhin ang bawat agent
Dots
- Isulat ang Custom Rules mo bago ikonekta ang email, at tukuyin kung pinapayagan, kailangan ng pag-apruba, o ipinagbabawal ang bawat pagkilos.
- Iwanang naka-on ang proactive research; sa mode na ito, maaari lamang tumingin ang Dot at hindi ito makakapagpadala o makakapag-edit.
- Isa-isang ikonekta ang mga app mula sa plugin directory, at huwag munang gumamit ng mga tool para sa pagbabangko at pangangasiwa sa unang linggo.
- Ikonekta lang ang sarili mong computer kapag kailangan ito ng isang gawain, at bawiin ang access kapag tapos na ang gawain.
- Regular na tingnan ang Activity View, pati ang mga gawaing ginawa ng Dot mo sa background.
- Kung personal plan ang gamit mo, magpasya sa mga kontrol ng data kung mananatiling naka-on ang Improve the model for everyone, dahil tinutukoy ng setting na ito kung gagamitin sa training ang ginawa ng Dot mo.
Muse
- Ilagay sa malinaw na tagubilin na dapat panatilihing pribado ng Muse ang address, numero ng telepono, at iskedyul mo.
- Atasan itong humingi ng pag-apruba bago magbayad, tumanggap ng alok, o makipag-ugnayan sa sinumang bago.
- Huwag ibigay sa Muse ang address para sa pickup ng mga binebenta mo sa Marketplace; ikaw na mismo ang magbahagi nito.
- Huwag gamitin sa Amazon; bina-block ng tindahan ang Muse at binabalaan ang mga mamimili tungkol sa mga hindi awtorisadong agent.
- Ikonekta lang ang mga sensitibong account kapag kailangan ng mga ito ang isang gawain, dahil kokopyahin sa Muse VM mo ang anumang ikinonekta mo.
- I-update agad ang app at basahin ang mga babalang pangkaligtasan ng Meta sa loob ng app.
Gemini Spark
- Tingnan kung alin sa Photos, Chrome, Drive, Docs, Calendar, at Gmail ang mabubuksan ng Spark, at alisin ang hindi kailangan sa mga una mong gawain.
- Mahigpit na subaybayan sa simula ang mga gawaing sinisimulan ng mga event, at ihinto ang anumang gawaing lumilihis sa dapat nitong gawin.
- Paminsan-minsan, suriin ang mga naka-iskedyul mong gawain at alisin ang mga hindi mo na kailangan.
- Magpatakbo ng ilang gawaing malinaw ang saklaw sa halip na punuin ang lahat ng 15 puwesto.
- Kung pangnegosyo ang account mo, itanong sa Workspace admin mo kung aling mga paghihigpit sa Spark ang ipinapatupad.
Claude
- Limitahan ang mga connector sa kailangan ng kasalukuyang gawain, at idiskonekta ang mga ito pagkatapos.
- Sabihin kay Claude kung aling mga source ang maaari nitong gamitin sa pananaliksik, dahil pinalalawak ng bawat connector ang mababasa nito.
- Basahin ang prompt ng pahintulot na ipinapakita ni Claude bago ito kumilos sa isang nakakonektang app; huwag basta mag-apruba dahil nakasanayan na.
- Suriin ang mga ginawang dokumento bago ibahagi ang mga ito; maaaring may laman ang mga ito mula sa mga nakakonektang file mo.
OpenClaw
- Gamitin ang pinakabagong stable release; may mga kilalang kritikal na kahinaan ang mga bersyong mas luma sa 2026.4.22.
- Panatilihing loopback ang gateway.bind at kumonekta sa gateway gamit ang SSH o Tailscale, hindi kailanman sa pamamagitan ng bukas na port.
- Itakda ang dmPolicy sa pairing para code, hindi access, ang matanggap ng estrangherong magmemensahe sa bot mo.
- Itakda ang mga pag-apruba sa exec sa palaging magtanong, at panatilihing naka-off ang elevated mode.
- Regular na patakbuhin ang openclaw security audit, at mag-install ng kaunting skills hangga't maaari, mula lamang sa mga source na pinagkakatiwalaan mo.
- Kung gumamit ka na ng bersyong mas luma sa 2026.4.22, palitan ang bawat key na maaaring maabot ng agent.
Checklist sa kaligtasan
Lagyan ng tsek ang bawat item kapag natapos mo na; sa browser na ito lang mase-save ang iyong progreso.
Talaan ng mga insidente ng agent
Mga naitalang insidente: 11 →Kinansela ng OpenAI ang GPT-6.1 Astra dahil sa mga resulta ng pagsusuri
Setyembre 28, 2026 · PagkapribadoIbinigay ng Muse sa isang mamimili sa Marketplace ang tirahan ng gumagamit nito
Setyembre 25, 2026 · PagkapribadoNag-upload ang mga research agent ng OpenAI ng 53 larawan ng mga user sa mga site na nagho-host ng larawan
Setyembre 25, 2026 · KahinaanInilahad ng ulat sa bug bounty ang paraan para makapasok sa mga virtual machine ng Muse
Mga tanong
Aling setting ang pinakamahalaga?
Pag-apruba para sa anumang hindi mo na mababawi: mga pagbabayad, ipinadalang mensahe, pagbura at pagbabahagi ng personal na detalye. Nagsimula ang ilang insidente sa pahinang ito nang kumilos ang agent nang hindi muna nagtatanong.
Ano ang prompt injection?
Ito ay tekstong nakatago sa web page, email, dokumento o plugin na binabasa ng agent at sinusunod na para bang ikaw ang sumulat nito. Magtakda ng panuntunang ituturing na impormasyon lamang ang panlabas na content, panatilihing nangangailangan ng pag-apruba ang mga aksiyong hindi na mababawi, at kumonekta sa pinakakaunting source hangga't maaari.
Mas ligtas ba ang self-hosted na agent tulad ng OpenClaw kaysa sa cloud agent?
Nananatili ang data mo sa sarili mong hardware, pero ikaw ang nagiging security team. Sa ngayon, karamihan sa mga insidente sa OpenClaw ay nag-ugat sa mga gateway na lantad sa publiko at mga lumang bersyon. Kaya i-bind ang gateway sa loopback, panatilihing naka-on ang pagpapares ng DM, hingin ang pag-apruba para sa mga shell command at mag-update agad.
Ginagamit ba sa pagsasanay ang mga ginagawa ng agent ko?
Depende ito sa produkto at plan. Sa Dots, hindi ginagamit bilang default sa pagsasanay ang mga workspace ng Business, Enterprise at Edu. Para sa mga personal na plan, sinusunod ang kasalukuyan mong setting sa pagsasanay ng ChatGPT. Ayon naman sa OpenAI, hindi direktang ginagamit sa pagsasanay ang mga pribadong tala at pananaliksik sa background ng isang Dot.