Галоўная / Артыкулы / Практычныя прыказкі: АІ-агент – це простаў АІ-модель з канструкцыяй для ўпоркі.

Практычныя прыказкі: АІ-агент – це простаў АІ-модель з канструкцыяй для ўпоркі.

Практычныя прыказкі: АІ-агент – це простаў АІ-модель з канструкцыяй для ўпоркі: контракты, пераказы та слоты для коду для команд, якія викорыстоўваюць гэты патерн.

2451 слоў

Наступныя прытамлівкі паказваюць практычны шлях разбору тэмы «Агент AI — гэта проста модель AI з дадзеным інструментам». Акцэнт ставіцца на контракты, перакананняя та месцы для коду, а не на мотывацыйныя аспекты. Калі працуеце на стадіі адгляду, спачатку запісайце контракт: неабяжлівыя даннэ, сігнал успеху та тое, што выканаецца у разы ў частковай нявыполненасці. Такі список контроля дапамагае залишыцца чыстым пад час пазнейшых змен у кодзе. Валіце маленькія, тэставаныя елементы замест амаль неканчатых скрыптов. Калі якісь крок не выйшоў, прычына нявыполненасці павінна вказываць на адну конкрэтную адпаведальнасць, а не на заплутаны ланцужок задач.

Якщо LLM вже ўжо інтэлігентны, то чаму яму ваобща патрэбны дадзеныя інструментам?

Якщо LLM на даным этапе працюе найэфектывнейша, яго трэба расследжваць як меравальную суперфісу. Запісаце адна ідеальная транскрыпцыя, адзін прыклад неудачы і прыметку па поверненню да пачатковага стану пры расшырэнні масштаба. Расследжвайце гэты этап як кантракт межу вхіднымі даннымі і паўнастацэннымі выходамі. Дайце назвы артыфактам, задаце критэрыя успеху і адмовіцеся ад тыхоўскага частковага завершэння задання. Задаце бюджет токенав на кожны рунт і на кожную сесію. Агентскія інструменты агрэсывна расширваюць контекст; строгі ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі.

Што такое AI-агент і як інжынерыя Harness працоўвае над ператворэнням AI-моделі ў такі?

Этап «Што такое AI?» працюе найкраща, калі яго розглядаць як вимерную плошчу. Запісаце адна ідеальная транскрыпцыя, адзін прыклад неудачы і запіс працэў павернення да пярвоначальнага стану пры розшырэнні масштаба. Запісвайце часы выканання і кост токенав або запытаў па боку ад функцыйнальных рэзультатаў. Візуабілізацыя костаў з самага пачатку запобегае неспакойным рахункам, калі працэс пераходзіць з дэмавай версіі ў спяльныя сераўы. Задаце бюджет токенав на адну партію і на адну сесыю. Інструменты-агенты актыўна расширваюць контэкст; строгія ліміты не дазволяюць дэмавай версіям ператварыцца на неспакойныя рахункі.

Весь гэты концэпт можна спраўдзіць за дапамою адной простай формулы:

Весь гэты концэпт працюе найкраща, калі яго розглядаць як вимерную паверхню. Запісаўце адна «золатая» транскрыпцыя, адзін прыклад неудачы і запіс пра вярнэнне да пачатковага стану перш чым расширваць масштабы. Зберагаўце настройкі праза код аплікацыі. Файлы сяродавішча, хранільнікі секрэтных дадзеных і флагі функцый должны знаходзіцца ў аднам месцы, куды аператары можаць адбавляць контроль, не чытаючы весь граф. Задазвайце ліміты бюджету на кожны раунд і кожную сесію. Інструменты-агенты агрэсывна расширваюць контекст; жорсткія ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі.

AI Agent = AI Model + Harness

Этап моделі AI Agent працюе наякша, калі яго розглядаць як мерыемы аспект. Запісаце адна ідеальная версія роботы, адзін прыклад неудачы і прыметку па поверненню да пачатковага стану пры расшырэнні масштаба. Дакументавайце як успешны, так і варыянты вярнэння да нормальнага стану. Перапрыбуткі, людзкі контроль і обработка некоректных паведамленняў ёсць частью продукту, а не пасляднім элементам дапрацоўкі. Задаце ліміт токенав на кожны раунд і на кожную сесію. Інструменты агентав агрэсывна расширваюць контекст; строгі ліміты запобегаюць таму, каб дэманстрацыі ператварыліся на неспакоюючыя рахункі.

Популярныя AI Agentы

Работа з популярнымі AI-агентамі дае найкращыя результаты, калі яе розглядаць як меркаваную плошчу. Запісаце адна ідеальная версія роботы, адзін прыклад неудачы і прыметку па поверненню да попярэдньяго стану пры расшырэнні масштаба. Валіце маленькія, тэставаныя елементы замест большых скрыптов. Калі якісь крок не выйшае, прычына неудачы павінна вказываць на адзін конкрэтны элемент, а не на заплутаны ланцюг задач. Задаце ліміт токенав на кожны рунг і на кожную сесію. Інструменты агентав актыўна расширваюць контекст; строгі ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі.

Што такое AI-агент з адкрытымі параметрамі?

Этап «Што такое агент з адкрытым вагам» працюе наяўней, калі яго спрыяваць як мерыемую паверхню. Запісаце адна ідеальная версія рэзультата, адин прыклад неудачы і прыметку па вярнэнню да пачатковага стану пры расшырэнні масштаба. Спрыявайце гэты этап як кантракт межу вхіднымі дадзеннямі і паўнастацэннымі выходамі. Дайце назвы артыфактам, задаце критэрыя успеху і не падзеўляйцеся частым, некомплектным выкананнем задач. Задаце ліміт токенав на кожны раунд і на кожную сесію. Агентскія інструменты агрэсывна расширваюць контекст; жорсткія ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі.

Што такое агент AI з адкрытым кодам?

Этап «Што такое адкрыты код» працюе наяўней, калі яго спрыяваць як мерыемую паверхню. Запісаце адна ідеальная транскрыпцыя, адзін прыклад неудачы і прыметку па абратанню змян перад расшырэнням масштаба. Запісвайце часы выканання і кост токенав або запытаў па боку ад функцыйнальных рэзультатаў. Візуабельнасць костаў з самага пачатку запобегае неспакойным рахункам, калі працэс пераходзіць з дэмавай версіі ў спяльныя сераўры. Задаце бюджет токенав на кожны раунд і на кожную сесію. Інструменты з агентным падходам актыўна расшырваюць контэкст; строгія ліміты не дазволяюць дэмавай версіям ператварыцца на неспакойныя рахункі.

Kimi ад Moonshot AI

Этап Kimi адмініструемы Moonshot AI працюе наявнасцю калі яго спрыяваць як до меры. Зберагчыце адна ідеальная транскрыпцыя, адзін прыклад неудачы і запіс пра вярнэнне да пачатковага стану, перш чым расширваць сферу дзеяння. Храніце настройкі параду ад коду прыемлівання. Файлы сераўнавальнага сяродавішча, хранілішчы секрэтных дадзеных і флагі функцый должны знаходзіцца ў аднам месцы, куды аператары можаць адбавляць контроль без неабяжнага чытання всіх элементаў. Задаце ліміты токенав на кожны раунд і на кожную сесію. Інструменты-агенты агрэсывна расширваюць контекст; строгі ліміты запобегаюць таму, каб дэманстрацыі ператварыліся на неспакоючыя рахункі. Этап Kimi адмініструемы Moonshot AI працюе наявнасцю калі яго спрыяваць як до меры. Зберагчыце адна ідеальная транскрыпцыя, адзін прыклад неудачы і запіс пра вярнэнне да пачатковага стану, перш чым расширваць сферу дзеяння. Валіце малыя, тэставаныя елементы замест большых скрыптов. Калі якісь крок не выйшае, прычына неудачы должна вказываць на адну адпаведную адпаведальнасць, а не на заплутаны ланцоўкі дзеяння.

Як моцны канструкт павышае эфектывасць AI-агента?

Для стадіі «Як функцыонуе сильная система» неабяжна прадзефінаваць вхідныя даны, адпраўніка крока і крэтыяры завершэння перад змінайом коду. Аперацыяныя працавнікі должны магчымае перадзеўжваць крок з вядомай точкі контролю, не падозрываючы прыхованы стан. Спрацавляйце з гэтай стадіяй як з кантрактом межа вхіднымі данымі і падтверджанымі выходнымі рэзультатамі. Даўце назвы артыфактам, прадзефінаваць перагляды успеху і адмовіцеся ад беззвучнага частковага завершэння. Калі наступны крок — це код або вызов інструмента, валідаваць структураваныя выходныя даны з валідацыёю схемы лепш, чым прозу без стройлогіі.

Адчыненне структуры папак

У стадії доступу дахрэмкі фолдара неабяжна ўзначыць вхідныя даны, адпаведальнага за этап і крэтыры завершэння пры змяне коду. Аперацыйныя працавнікі павінны магчымае перазапускаць этап з вядомай точкі контролю, не прабуючы спадарожваць схованы стан. Запісвайце час выконання і кост токена або запыту празаўседле з рэзультатамі функцыянальнай працы. Візуабельнае паказанне костаў з’являецца перашкодай неспакою, калі парадокс перейшае з дэмавай версіі ў спяльнаныя среды. Калі наступны этап — гэта код або вызов інструмента, лепш выкарыстоўваць структураваныя выходныя даны з перакананнем схэмы, чым вольнае пісьменне.

Чаму інструмент для ацэнкі такі ж важны, як і інструмент для агента?

У стадії «Чаму? — Эгзалюцыя» неабходна практычная дэфініцыя вхідных даных, адпаведальнага за крок і крэтарыяў завершэння працы перад змінайом коду. Аператары должны магчымае перзапускать крок з вядомай точкі контролю, не спрабоўваючы здогадвацца пра схованы стан. Конфігурацыю трэба знаходзіць за межамі коду прыемленае. Файлы сераўнавання, хранільнікі секрэтных дадзеных і флагі функцыйяў должны быць аднароджаны ў аднам месца, якое аператары можаць пераглядаць, не чытаючы весь ланцуг задач. Калі наступны крок — це код або вызов інструмента, лепш выкарыстоўваць структураваныя выходны даны з пераканальваннем схэмы, чым вольнае пісьменне выказванне. У стадії «Чаму? — Эгзалюцыя» неабходна практычная дэфініцыя вхідных даных, адпаведальнага за крок і крэтарыяў завершэння працы перад змінайом коду. Аператары должны магчымае перзапускать крок з вядомай точкі контролю, не спрабоўваючы здагадвацца пра схованы стан. Лепш выкарыстоўваць маленькія, тэставаныя елементы, чым велікія скрыпты. Калі крок не выйшоў, прычына неудачы должна вказываць на адну конкрэтную адпаведальнасць, а не на заплутаны ланцуг задач.

Чаму ацэнкаеў становіцца цэнтральным элементам

Калі працуеце над этапам «Чаму ацэнкаеў становіцца цэнтральным элементам», спачатку запісайце угоду: неабходныя даны, сигнал успеху і тое, што выканаецца у разы ў частковай нявыполненасці. Такі список пераканае ў тым, што пазнейшыя змены коду буду чыстымі. Спрыймайце гэты этап як угоду між вхіднымі данымі і перакананымі выходнымі рэзультатамі. Дайце назвы элементам, задаце критэрыя успеху і не падтрымайце тыхню частковую завершэннасць. Зберагаеце у кешы стабільныя інструкцыі системы та схемы інструментаў. Перадача ідэнтычных прамулкіў є частым выкарыстоўваннем ресурсаў.

Вывык

Калі працюеце над стадзіяй Заключэння, спачатку запісайце угоду: неабяжлівыя даны, сігнал успеху і тое, што выходзіць у разе частковага нявыпання. Такі список пераконвае ў тым, што пазнейшыя змены коду будуць чыстымі. Запісвайце час выканання і кост токена або запыту праза функцыйнальнымі рэзултатамі. Відразы коста з самага пачатку запобегае неспакоўным рахункам, калі працэс пераходзіць з дэмаверыяна ў спакульнаныя сераўысы. Зберагайце у кэшы стабільныя інструкцыі системы і схемы інструментаў. Перадзял у тое ж самае прамэру ёсць частым выклікам затрат.

Чы модэль яшчэ мае значэнне?

Калі працюеце над стадзіяй «Чы гэты модель мае значэнне?», спачатку запісайце контракт: неабяжлівыя даннэ, сигнал успеху і тое, што выканаецца пад частым неудачам. Такі список контроля дапамагае заліцьвараць пасляэйшныя змены ў кодзе. Зберагаюце настройкі за межамі коду прыемлі. Файлы сераўнавання, храненні секрэтных данных і флагі функцыйяў должны знаходзіцца ў аднам месцы, куды аператары можаюць адбавіць аудыт без неабяжлівага чытання всей структуры. Кэшавайце стабільныя інструкцыі системы і схемы інструментаў. Перадзесланне ідэнтычных даных ўсё часта стае прычыной зайвых витрацоў. Калі працюеце над стадзіяй «Чы гэты модель мае значэнне?», спачатку запісайце контракт: неабяжлівыя даннэ, сигнал успеху і тое, што выканаецца пад частым неудачам. Такі список контроля дапамагае заліцьвараць пасляэйшныя змены ў кодзе. Валіце маленькія, тэставаныя елементы замест большых скрыптаў. Калі які-небудзь крок не выйшае, неудача должна вказваць на адну конкрэтную адпаведальнасць, а не на заплутаную структуру працы.

Модель задае межы можлівасцяў.

Модэль працюе наявнасцю калі яе спрыяваць як до меры можна паверхню. Запісаце адны «золаты» прыклад, адну справу з бягам і прыметку пра вярнэнне да пачатковага стану перш чым расширваць масштабы. Спрыяваць гэты этап як кантракт межа вхіднымі дадзеннямі і паверанымі выходамі. Даеце назвы артыфактам, задаеце критэрыі успеху і не падзеляецеся на частковыя рашчынення без адказу. Задаеце ліміт токенав на кожны раунд і на кожную сесію. Інструменты-агенты агрэсывна расширваюць контекст; строгі ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі.

Спрыяваць ператварае гэтыя можлівасці у павтаральнае выкананне задач.

Шыньцей, гэты этап працюе наяўнейша, калі яго спрыяваць як меравальную паверхню. Запісаце адна «золатая» транскрыпцыю, адзін прыклад неудачы і запіс пра вярнэнне да пачатковага стану перш чым расширваць масштабы. Запісвайте час выканання і косць токеноў або запытак па боку ад функцыйнальных рэзультатаў. Візуабельнасць косцаў з самага пачатку запобегае неспакойным рахункам, калі процес пераходзіць з дэмаверсіі ў спяльныя сераўы. Задаце бюджет токеноў на адну партію і на адну сесію. Інструменты-агенты актыўна расширваюць контэкст; строгія ліміты не дазволяюць дэмаверсіям ператварыцца на неспакойныя рахункі.

Аналіз паказвае нам, чы рэальна цэлая система працавала.

The eval паказвае, што стадія працюе найкраща, калі яе спрыяваць як меравальную паверхню. Зберагчыце адны ідеальны прыклад роботы, адны прыклад неудачы і запіс пра вярнэнне да пачатковага стану, перш чым расширваць масштабы. Храніце настройкі за межамі коду прыемлі. Файлы сяродавішняе сераўісу, хранальнікі секрэтных дадзеных і флагі функцыйяў должны знаходзіцца ў аднам месцы, куды аператары можаць адбавляць контроль, не чытаючы весь ланцуг. Задавайце ліміты токенам на кожны раунд і на кожную сесію. Інструменты-агенты агрэсывна расширваюць контекст; строгі ліміты не дазволяюць дэмам ператварыцца на неспакоўныя рахункі. The eval паказвае, што стадія працюе найкраща, калі яе спрыяваць як меравальную паверхню. Зберагчыце адны ідеальны прыклад роботы, адны прыклад неудачы і запіс пра вярнэнне да пачатковага стану, перш чым расширваць масштабы. Валіце маленькія, тэставаныя елементы замест большых скрыптов. Калі які-небудзь крок не выйшае, неудача должна вказываць на адну адпаведную адпавядальнасць, а не на заплутаны ланцуг задач.

Чы можа модель AI стаць справжнім, функцыйнальным агентам AI без спецыяльных інструментаў?

Для стадіі «Можа ля АІ-модэль» неабходна прадзефінаванне вхідных дадзеных, адпраўніка крока і крэтарыяў завершэння перад зменым коду. Аперацыяныя працавнікі павінны магчымае перзапускаць крок з вядомай точкі контролю, не падозрываючы прыхованы стан. Спрацавляйце з гэтай стадіяй як з кантрактом межа вхіднымі дадзенымі і пасвярджанымі выходнымі рэзультатамі. Даўце назвы артыфактам, прадзефінавце перакананні на успех і адмовіцеся ад бяспрэчнага частковага завершэння. Калі наступны крок — гэта код або вызов інструмента, валідаваць краща структураваныя выходныя рэзультаты з валідацыёю схемы, чым прозу без страктуры.

Разлік:

У стадії падробнага аналізу неабяжна ўважна вказаць усіх параметраў, адпаведальнага за выкананне крока і крэтарыяў завершэння працы, перш чым змяніць код. Аператары должны магчымае перзапускіць крок з вядомай точкі контролю, не прабуючы спадарожваць схованы стан. Запісвайце час выканання і вартась токенаў або запытак праза рэзультаты функцыйнасці. Відразлівае паказанне вартасей запобегае неспадзяваным расчыткам, калі процес пераходзіць з дэмавайнага режыма ў спяльныя среды. Калі наступны крок — гэта код або вызов інструмента, лепш выкарыстоўваць структураваныя выходныя данні з перакананнем схэмы, чым вольныя тэкстовыя форматы.

Справакі

У стадії «Апавяранні» неабходна ўзначэнне вхідных дадзеных, адпавядаючага за крок і крэтарыяў завершэння працы перад зменым коду. Аперацыйныя працавнікі должны магчымае запускаць крок з вядомай точкі контролю, не падозрываючы прыхованы стан. Конфігурацыю трэба захаваць паза кодам прыемлі. Файлы сераўіса, хранальнікі секрэтных дадзеных і флагі функцый належаць у аднам месца, якое працавнікі можуць пераглядаць, не чытаючы весь ланцуг задач. Калі наступны крок — це код або вызов інструмента, лепш выкарыстоўваць структураваныя выходныя данні з перакананням схемы, чым вольныя тэкстовыя апісанні. У стадії «Апавяранні» неабходна ўзначэнне вхідных дадзеных, адпавядаючага за крок і крэтарыяў завершэння працы перад зменым коду. Аперацыйныя працавнікі должны магчымае запускаць крок з вядомай точкі контролю, не падозрываючы прыхованы стан. Лепш выкарыстоўваць маленькія, тэставаныя елементы, чым велікія скрыпты. Калі крок не выйшаў, прычына неудачы должна вказываць на адну конкрэтную адпавядачнасць, а не на заплутаны ланцуг задач.

Якщо вы хочаце звяжыцца з мной, гэта мой профіль у LinkedIn.

Калі працуеце над этапам, каб запусканы проект, спачатку запісайце угоду: неабяжлівыя данні, сігнал успеху і тое, што выходзіць у разе частковага невыпання. Такі список пераконтроўкаў дапамагае заліцьваты змяны ў кодзе. Спрыймайце гэты этап як угоду межа даннімі і перакананымі рэзультатамі. Дайце назву кожнам элементам, задаць критэрыя успеху і не падтрымайце часткова завершэнне без паведамлення.

Чек-ліст для эксплуатацыі

Для этапа чек-ліста для эксплуатацыі, перш чым зменяць код, задаць неабяжлівыя данні, адпаведальную особу за крок і критэрыя завершэння. Аперацыйныя працавнікі должны магчыма было перазапускаць крок з вядомай точкі контролю, не спрабоўваючы здагадвацца пра схованы стан.

Запісвайце адно часовы лянцюг успеху і лянцюг вярнення. Прабавы, людзкіе контраліны і обработка некоректных паведамленняў ёсць часткай продукту, а не пасляднім дапрацоўкам.

Калі наступны крок — гэта код чыя-небудзь вызов адзінкі, волейце структураваныя выходны данні з паўерыяванням схемы замест свабоднага тексту.

Запісвайце назву адзінкі, хэш параметраў, час адпаведзення і рынак кожнага вызову. Без такога лёгкага следу дэбагаванне агента губіць гадзіны.

Зберагайце стан графа ў простам і типаваным формате. Вярнутыя блокі маскуюць, калькі вузел запісаў калькі поль, і спакойваюць працэс пасля перарываў.

Калі дозволяе бюджет, дадзіце тэст на працэс критычнага лянцюга ў CI з фікстурамі, а не за дапамогою рэальных платных API.

Перш чым запускать стак, заморозьце версіі, зафіксавце «золаты» транскрыпты для критычнага шляху і паказвце спосабы абяроны. У спільных средах неабходны ліміты частоты запытоў, перакананні ў правах на выкарыстоўванне ресурсаў і чысткі власнік для змены секрэтных даных. Валіце простую надзейнасць працы над крэатывнымі, але разовымі дамаваннямі.

Прыметкі для e607fe6d36f7: не кладзіце ключы прадаўцаў у репазітарый, задаце верхнюю межу токенаў на кожную сесію і зберагачыце транскрыпты празаўседы ў фікстурах eval, каб пазнейшыя замены модэляў заставаліся пораўнанымі.