Уян хатан зохицуулалт шаарддаг нээлттэй даалгаварт хөнгөн хамгаалалт болон код ажиллуулдаг агентууд илүү тохиромжтой. Учир нь хэт хатуу зохион байгуулалт нь загварын гүйцэтгэлийг хязгаарлаж болзошгүй.
Иймээс код ажиллуулах болон тусгаарлагдсан орчин бүрдүүлэх нь агентад суурилсан системийн архитектурын үндсэн асуудал болоод байна.
Agents SDK нь код ажиллуулдаг агент бүтээхэд шаардагдах нарийн төвөгтэй байдал, кодын хэмжээг багасгадаг. Бидний туршилтаар зарим тохиолдолд 6 дахин багассан.
Удаан хугацааны турш агент системийн ахиц нь зохион байгуулалтыг сайжруулахад тулгуурлаж ирсэн. Үүнд илүү сайн өгөгдөл боловсруулах, хэрэгслийн интерфейс, контекстийн удирдлага, хяналтын илүү нарийн урсгал багтана. Гэвч код бичдэг агентуудын чадавх нэмэгдэхийн хэрээр энэ тэнцвэр өөрчлөгдөж эхэлж байна.
Олон нээлттэй ажлын урсгалд гол саад нь агентын давталт байхаа больж, харин гүйцэтгэлийн давхарга болжээ. Энэ нь загвар код бичих, команд ажиллуулах, үр дүнг шалгах, давтан сайжруулах тусгаарлагдсан орчин юм. Даалгаврын түвшний сэтгэн бодох үйл явц энэ орчинд улам их шилжихийн хэрээр загварын бүрэн чадавхыг ашиглуулахын тулд хүрээлэн буй зохион байгуулалтыг хялбарчлах шаардлагатай.
Agents SDK-ийн шинэ хувилбар яг ийм өөрчлөлтийг хэрэгжүүлэх боломж олгодог. Эрт хандалтын үеэр хийсэн туршилтаас харахад энэ нь фреймворкийн логикийн дахин нэг давхарга нэмэхийн оронд гүйцэтгэлийн давхаргыг илүү модульчлагдсан, хослуулан ашиглах боломжтой болгож, системийн бусад хэсгийг хөнгөн байлгадаг.
Хамгаалалтын инженерчлэлд хамгаалалтыг үр дүнтэй ажиллах хамгийн энгийн хэлбэрт хүргэх нь түгээмэл чиг хандлага болоод байна. Ерөнхийд нь хэлбэл, хамгаалалт гэдэг нь загварыг хүрээлэх програм хангамж юм. Энэ давхарга контекст, хэрэгсэл, хяналтын урсгал, санал хүсэлтийн давталтыг удирдаж, загварыг найдвартай ажиллах нөхцөлөөр хангадаг.
Сүүлийн хэдэн жилд агентын гүйцэтгэлийн олон сайжруулалт энэ давхаргыг бэхжүүлснээр бий болсон. Илүү сайн хэрэгсэл, санах ой ба мэдээлэл сэргээх чадвар, илүү тодорхой задаргаа, нарийн зохион байгуулалт нь системийг илүү найдвартай, чадварлаг болгодог байв. Энэ загварын дагуу ахиц гаргана гэдэг нь даалгаврын логикийг загварыг хүрээлэх програм хангамжид улам ихээр шингээхийг голчлон хэлдэг байлаа.
Харин нээлттэй даалгаврын зарим төрөлд энэ хандлагын ач холбогдол буурч байна. Хамгаалалт илүү хатуу зааварчилгаатай болох бүрд гүйцэтгэл заавал сайжирдаггүйг улам олон төсөл, судалгааны өгүүлэл харуулж байна. Код бичихэд туслах, удаан үргэлжлэх даалгавар, хөтөч ашиглах, урт контексттэй даалгавар зэрэгт ижил хэв шинж давтагдана: загвар хангалттай ухаалаг болсон үед даалгаврын хэт их бүтцийг хүрээлэн буй програм хангамжид албадан оруулах нь давуу тал бус, хязгаарлалт болж болно.
Ийнхүү хамгаалалтын үүрэг өөрчлөгдөж байна. Хамгаалалт нь хатуу зохион байгуулалтаар даалгаврыг урьдчилан таамаглахын оронд цэвэр гүйцэтгэлийн орчин бүрдүүлэх үүргийг улам ихээр гүйцэтгэж байна. Энэ нь загвар төлөвийг шалгах, код ажиллуулах, алдаанаас сэргэх, системийн интерфейс болон хамгаалалтын арга хэмжээнд захирагдангаа арга барилаа өөрөө тохируулах тусгаарлагдсан орчин юм. Энэ нь Андрей Карпати Software Engineer 3.0-д тайлбарласан өөрчлөлттэй төстэй: өмнө нь програм хангамжид байсан зарим логик дээш шилжин, «өгөгдөл»-ийн хэсэг болдог.
Эндээс агент системийн бүх бүтцийг арилгах ёстой гэсэн дүгнэлт гарахгүй. Ялангуяа явцуу хүрээтэй, их хэмжээний эсвэл амжилтыг тодорхой хэмжих боломжтой даалгаварт ил тод ажлын урсгал, эвристик арга, тодорхой дүрэмд суурилсан хамгаалалт үр өгөөжтэй хэвээр байна. Агентад суурилсан системийн дизайны эвристик аргууд нийтлэлдээ дурдсанчлан, найдвартай логик урсгал бүрдүүлэх боломжтой бөгөөд шаардлагатай үед хүчирхэг зохион байгуулалт чухал хэвээр.
Харин нээлттэй даалгаврын хувьд гол анхаарал өөрчлөгдөж байна. Одоо улам нарийн зохион байгуулалтын давхарга зохиохоос илүүтэй загвар дотор нь үр дүнтэй ажиллахуйц энгийн, ажиглах боломжтой, модульчлагдсан гүйцэтгэлийн орчин бүрдүүлэх нь гол сорилт болж байна.
Агент файл уншиж, код бичиж, бүрхүүлийн команд ажиллуулан, удаан үргэлжлэх даалгавар эхлүүлж чаддаг болмогц инженерчлэлийн сорилт өөрчлөгдөнө. Хамгийн хэцүү хэсэг нь зөвхөн өгөгдлийг оновчлох эсвэл хэрэгслийг чиглүүлэх байхаа больсон. Агент бодит систем дээр ажилладаг болсноор эдгээр агентын хүчин чадал үлэмж нэмэгдэнэ. Гэвч аюулгүй байдал, хамгаалалтын эрсдэлийн хүрээ тэлэх тул илүү эмзэг болно. Жишээлбэл, орчин нь хангалттай тусгаарлагдаагүй бол код ажиллуулах чадвартай агент хор хөнөөлтэй үйлдэл хийж болно (AISI-ийн Sandbox Bench-ийг үзнэ үү).
Тиймээс тусгаарлагдсан орчин бүрдүүлэх нь агентын фреймворкийн нэн чухал асуудал болж байна. Өмнөх системүүдэд гүйцэтгэлийг ихэвчлэн хамгаалалтад нэмж бэхэлсэн хэрэгсэл буюу нэмэлт боломж гэж үздэг байв. Гэвч гүйцэтгэл төлөв хадгалдаг, удаан үргэлжилдэг эсвэл алсын орчинд явагддаг болмогц энэ арга ажиллахаа больж эхэлдэг. Тусгаарлагдсан орчин, түүний амьдралын мөчлөг, төлөв, интерфейс болон агентын давталттай холбогдох ажиллагааг удирдах нь удалгүй бие даасан системийн дизайны асуудал болдог. Тиймээс OpenAI-ийн Container API болон shell хэрэгсэл, Modal, Cloudflare, Daytona, E2B зэрэг улам олон үйлчилгээ үзүүлэгч код ажиллуулах удирдлагатай орчин санал болгож байна.
Кодын гүйцэтгэлд хамгаалалтын бусад хэсгээс илүү хүчтэй тусгаарлалт, ажиллах үеийн нарийн хяналт шаардлагатай тул энэ зааг чухал. Бодит хэрэглээнд код ажиллуулдаг агентыг муу хэрэгжүүлбэл бизнест нэн чухал гурван эрсдэл үүснэ: тооцооллын хяналтгүй зардал, дотоод системийг сүйтгэх үйлдэл, эмзэг мэдээлэл задрах. Контейнерчлэл, тусгаарлалт, ажиллах үеийн хамгаалалтыг зөв хэрэгжүүлснээр эдгээр эрсдэлийг бодит орчинд нэвтрүүлэхэд зөвшөөрч болох түвшинд барьж болно.
Үүнийг агентын гарт бүх оффисын түлхүүр өгөхийн оронд өөрийнх нь битүүмжилсэн ажлын талбар олгож байна гэж төсөөлж болно. Агент тэр орчинд хэрэгтэй ажил хийж чадна, гэхдээ зөвхөн тодорхой тогтоосон хязгаарын дотор ажиллана. Та агентын ашиглах тооцооллын хэмжээг хязгаарлаж, ямар систем, файлд хандахыг нь тогтоон, анхнаасаа ямар мэдээлэл ашиглах боломжтойг хянаж болно.
Энэ нь эрсдэлийг бүрэн арилгахгүй ч асуудлыг «дэд бүтцэд тань чөлөөтэй ажиллах агент»-аас «хяналттай орчинд ажиллах агент» болгон өөрчилнө. Хэрэв энэ давхарга агент системийн стандарт хэсэг болох гэж байгаа бол фреймворк өөрөө үүнийг үндсэн боломжийн түвшинд дэмжих ёстой. Ингэснээр тусгаарлагдсан орчин нь хөгжүүлэгчид хурдан нэвтрүүлж, үйлчилгээ үзүүлэгч хооронд сольж, агентын логикийг байнга шинэчлэлгүйгээр өргөтгөж болох зөөврийн үндсэн бүрэлдэхүүнтэй, модульчлагдсан гүйцэтгэлийн давхарга болно.
Агент код ажиллуулдаг болмогц тусгаарлагдсан орчныг нь мөн зохион байгуулах шаардлагатай. Локал туршилтын загвараас алсын гүйцэтгэл, олон арын систем эсвэл удаан үргэлжлэх сесс рүү шилжихэд үйл ажиллагааны ачаалал асар их нэмэгддэг. Орчин үүсгэх, зогсоох, түр паузлаад үргэлжлүүлэх, төлөвийн агшин зураг авах, дараа нь дахин холбогдох болон энэ бүхнийг үйлчилгээ үзүүлэгч бүрд удирдах нэгдсэн арга хэрэгтэй.
Эдгээр нь үзэл санааны хувьд сүртэй зүйл биш ч бодит хэрэглээнд чухал. Ялангуяа агентын фреймворкт нэгтгээгүй үед баг бүр агентад суурилсан дамжлагыг эхнээс нь дахин бүтээвэл ийм дэд бүтэц маш их төвөг учруулдаг…
Энд л фреймворкийн илүү сайн дэмжлэг чухал болно. Бид OpenAI Agents SDK-ийн шинэ хувилбарт эрт хандаж, тусгаарлагдсан орчинтой агентуудыг өөрсдөө бүтээсэн. Архитектурын гол анхаарал өөрчлөгдсөн нь онцгой байв: SDK нь гүйцэтгэлийг захын хэрэгсэл бус, үндсэн давхарга гэж үздэг. Бодит хэрэглээнд тусгаарлагдсан орчинтой агент эхлүүлэх, орчны агшин зураг авах эсвэл гүйцэтгэлийг үргэлжлүүлэхэд бага код шаардана (бидний зарим туршилтаар ойролцоогоор 6 дахин бага). Дараа нь хүрээлэн буй агентын логикийг дахин бичихгүйгээр арын системээ сольж болно.
Үүргийг ингэж цэвэр заагласнаар хамгаалалт сэтгэн бодох, контекст, ажлын урсгалдаа төвлөрч чадна. Харин гүйцэтгэлийн давхарга тусгаарлалт, зөөврийн байдал, ажиллах үеийн төлөвт төвлөрнө. Энэ хийсвэрлэл нь илүү чадварлаг, цааш хөгжүүлэхэд хялбар код бичдэг агент бүтээх боломж олгоно. Ийм агент локал болон алсын гүйцэтгэлийн хооронд шилжиж, удаан үргэлжлэх даалгаврыг дэмжиж, бүх системийг дахин зохиохгүйгээр гүйцэтгэлийн арын системээ сольж чадна.
Даалгаврын түвшний логик хамгаалалтаас загвар руу улам их шилжихийн хэрээр системийн нарийн төвөгтэй байдлын нэг хэсэг дагаж доошлон, гүйцэтгэлийн давхаргад очно. Код ажиллуулах болон тусгаарлагдсан орчин бүрдүүлэх нь агентад суурилсан системийн, ялангуяа код их шаарддаг, нээлттэй даалгаврын архитектурын үндсэн асуудал болоод байна. Агентад суурилсан дамжлагыг зохиохын зэрэгцээ агент аюулгүй, найдвартай, удаан хугацаанд ажиллах орчныг бүрдүүлэх нь мөн адил чухал болжээ.
Тиймээс тусгаарлагдсан орчин дахь гүйцэтгэлийг удирдах дээд түвшний хийсвэрлэл чухал. Шинэ OpenAI Agents SDK нь гүйцэтгэлийг системийн модульчлагдсан давхарга гэж үзэн энэ чиглэлд ахиж байна. Энэ давхарга арын системүүдийн хооронд зөөврийн, удаан үргэлжлэх даалгаврын турш төлөвөө хадгалдаг бөгөөд шинэ тохиргоо бүрд ижил дэд бүтцийг дахин бүтээх шаардлагагүйгээр ашиглахад хангалттай энгийн.
Ерөнхий дүгнэлт нь агентын дараагийн үеийн фреймворкуудыг зохион байгуулалтын хэр их логик нэмснээр нь бус, агентуудын улам их түшиглэх болсон гүйцэтгэлийн орчныг хэр сайн бүтэцчилснээр нь тодорхойлох бололтой.