Галоўная / Артыкулы / API агентаў OpenAI: кераваныя альтэрнатывы для спецыяльных фрамворкаў агентаў

API агентаў OpenAI: кераваныя альтэрнатывы для спецыяльных фрамворкаў агентаў

У этай статыце пояснюецца, як новая API Agents адказоўскай компаніі OpenAI керуе кантэкстам, оркестрацыяй інструментаў і средамі выканання, так што команды можаць не ствараць сабскладную інфраструктуру агентаў.

1161 слоў

OpenAI выклікала публічную бета-версію новага Agents API; кароткая версія такая: той самы рэшэнк, який выкарыстоўваецца ў Codex, тепер доступны як кераваны хмарны сервіс для ўсіх. У замяну стварэнню савага шара оркестрацыі вы проста апісваеце задачу, выбіраеце модель, пад’яоўваеце сваі інструменты і выбіраеце месца, дзе должен працаваць агент. Одна вызов API стварае агента, гатовага да выкарыстоўвання, пры чым усе складныя аспекты — обробка контэксту, планаванне інструментаў, коордынацыя падзадач — адбываецца і керуецца самай OpenAI.

Вы можетэ выкарыстоўваць будзь-якія інструменты та з’єднанні, на якія вам патрэбна дапамога, прыўязаць іх да средовішча типу sandbox, якое вы выбералі, і дазволіць агенту працаваць з ямі.

Одны вызов заменяе весь ваша фрэймворк

const client = new OpenAI();

const session = await client.beta.agents.sessions.create({
  agent: {
    model: "gpt-6-astra",
    tools: [{ type: "mcp", server_label: "observability" }],
    multi_agent: { enabled: true, max_concurrent_subagents: 3 },
  },
  environment: { type: "openai_hosted" },
  input: "Investigate the spike in 5xx errors for service-api over the last 30 minutes. Delegate the deployment, error, and dependency analysis to sub-agents. Save your findings and mitigation recommendations to /workspace/outputs."
});

Стварэнне надзеянага агента з нуля традыцыйна значыла вельмі большую канцэргавучасць: карыстоўванне механізмамі керавання объёмам контэксту, налагоджэнне викорыстання токенав у зв’язку з вызывамі інструментаў, а таксама ручная рэалізацыя логікі для синхронізацыі падзаданняў. API для агентаў створаны так, каб перавзяць на сябе весь гэты слой роботы:

  • Автаматычная стисненне контэксту: калі сесія набліжаецца да свайго ліміту контэксту, система сама адсекае і падсумавляе старэйшыя данні, таму вам не патрэбна спецыяльная логіка для падтрымкі дзейнасці дугага часу заданняў.
  • Вызывы інструментаў з адкладаным завантажэнням через пошук інструментаў, што пашантуюе кэшаванне моделі і зменшае загальны расход токенав.
  • Програмнае вызыванне інструментаў з падтрымкай паралельных вызываў і ўзаемнага з’єднання, так што толькі тыя часткі вялікага набора дадзеных, якія насправды маюць значэнне, прабываюць у контэксте галоўнага агента.
  • Вбудованая оркестрацыя кальмінаў: галоўны кальмін дзеліць складную задачу на часткі, перадае іх падкальмінам, які працуюць паралельна, і кожны падкальмін зберагае свой аўтанонімны контэкст.
  • Сервіс наразе працуе на найновейшым модэлі OpenAI — GPT-6-Astra.

    Выберыце сабе атмосферу выканання

    Не кожны кальмін мае аднаковыя патрэбны ў інфраструктуре, таму API кальмінаў працоўвае тры разныя спосабы выканання кальмінаў:

    • Сандбокс, які розмешчаны на серверах OpenAI і пабудаваны на той самый бэкенд, дзе вже працуюць Codex і ChatGPT
    • Самастаяна кераваная інфраструктура, дзе кальмін працуе безпасова ў вашай сабе VPC
    • Сандбоксы, кераваны партнерскімі прадаўцамі, укладаючы Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop і Vercel

    Тое, які шлях выбраць, залежыць ад таго, што вы прагнете оптымаціраваць. Для швайнарога стварэння пратотыпа хоставаная сандбокс-сервіс дапамагае рухацца да прынцыповай меты з мінімальнымі перашкодамі. Для продакшн-заданняў, якія вымагаюць салідарнасці з стандартамі аб маюць обмежэння ў розташоўкі дадзеных, работа ў сэрвісе вашай сопны VPC дае неабходную контроль. Кожны варыянт мае своія праблемы ў частцы вычысленняў, памяці, доступу да GPU, часаў запуску і цэнаў, таму вы можете падабраць среду да конкрэтнага заведамства.

    Сігналы ад першых корыстнікаў

    Нямаўклік група команд, якія прыменялі бета-версію, вэсна ўжо паведамілі аб аптымістычных рэзультатах:

    • Ciridae падняла своія балы ацэнкі з 0,71 да 0,85, а таксама зменіла час адпаведзення у чатыро разы
    • SafetyKit скасаваў 60 процэнтав костаў перагляду заданняў, а таксама паказаў значныя павышэння ў эфектывнасці токенаў
  • Рычагі канцэлавання гіфных агентаў зменіліся на 86 процэнтав пасля ад’ёднання харчувальнай системы ад шара песчанай корзіны
  • Тэхнічны дырэктар Ciridae паазначыў, што каманда працавала месцы над стварэнням сае внутраней системы для адзірвання та керавання падагентамі, і переход на керованы API прынёс негараздзевальныя, вимерлівыя выгоды без дадатковых налаштаванняў. Адгукніцельны момент у всіх гэтых рэзультатах прост: калі вы больш не адпавядаеце за падтрымку інфраструктуры спецыяльных агентаў, вы можетэ перакрысіць гэтыя зусілля на логіку, якая насправдзе робіць ваш продукт унікальным.

    Прозрачнае па проекту, а не „чорная скрынка“

    Этыя службы створаны на адмініструемайму базе апэнтэкстовага рашырэння Codex, а базавы код заступаецца публічна на GitHub. OpenAI керуе і падтрымвае інфраструктуру, ал нічога з основнай логікі выканання не ўтаімаецца — вы можете яго пераглядзець калі толькі захочаце. Гэта значыць, што для викорыстоўвання такой адмініструемайцы службы не трэба даваць доверлеў закрытай системе; прозрачнасць апэнтэкстовай базы пераходзіць і на сам продукт.

    Размышленні пра рэальныя косты

    Існуе жарт, які распространяецца, што гэты запуск прычыніў закрыцце падарадзоў стартапаў, і гэта не ўсё ж такі жарт. Калі прадаўцу платформы вдаецца аб’ём часткі основнай інфраструктуры ў адмініструемую прадукцыю, компаніі, чый весь продукт складаўся з таго проміжнага шару, раптам вынужданыя шукать новы падход.

    Разработчыкі вже выявілі сэрьзую проблему, яка стосуецца цэнавачання: адна спроба выкарыстоўвання засобу для адкрытага заведама може запусціць дзесяткі вызоў таких засобаў, і кожны з яных дадае свою павную інфармацыю пра ход выконання ў загальны контекст. Можна заплатіць значна большую суму, прычаму нават не досягнуўшы робочага рэзультата. Наразе OpenAI не ставіць допаможных платы за сам API Agents пад час публічнага бета-версія — вы плаціце толькі за токены, якія вы спрацоўвалі, і за выкарыстоўвання засобаў. это значыць, што вы еканаміце на витоках, зв’язаных з стварэнням і адрабаткай саеўной палаты, але можаце заплатіць больш за сам працэс выконання. Знаходжыць правильны баланс межу тым, насколькі агент актыўна автаматызуе вызоў засобаў, і тым, сколькі гэта коштуе, — гэта тое, што кожная команда павінна вырашыць сама.

    Практычны вывод

    Тэставанне новай концэпцыі агента ніколі не было такім дешавым і шырэзным. Команды, у якіх няма ўласнага внутрашняга стаку агентаў, тепер можаць будаваць прычымо да Codex і зовсім адмахнуцца ад базавых інжынерных рэшэнняў. Якщо ваша організацыя вядомае сабе фрэймворк агентаў, варта задаць конкрэтны пытанне: чы ўжо сама будова і адтульніце гэтага фрэймворка ёсць часткай таго, што робіць ваш продукт унікальным? Якщо нята, пераход на такую кераваную службу можа звалічыць значны час, які паклекаецца на інжынерную работу.

    API для агентаў застаецца у стадіі публічнага бета-версіі, і ў наступным етапе яго можна вжываць безкоштовна, таму няма прычын не створыць тэстовага агента за дапамогою адной вызову API і не пазірце, калі ён насправды можа выконваць.

    Этот запуск адаптуецца да шырэйшага тэндэнцу, калі большыя мовныя моделі продовжваюць складваць слоі, якія раней разрабоцы былі змушаны ствараць самі. Спачатку з’явіліся моделі як сервісы, потым — інструменты як сервісы, а тепер — ўсё ближэй да ботаў як сервісаў. Кожны крок прымушвае разрабоцых паднімацца вышэй у іерархію, ад інфраструктурных элементаў да стварэння прыкладнікаў і досвядзенняў, якія насправды робяць ўсё іхнё продакт неадначным — і гэты тэндэнц не паказвае ознак спамырання.

    Спадневанае чытанне

  • Розумеўце AI-агентаў: цялі, інструменты, память і цикл агента — проста для пачаткуючых інфармацыя пра тое, чым AI-агенты разлічаюцца ад чатботаў, з розглядам ключоўых складовых, циклу прыняцтва рашэнняў, рагів автонаміі і прыкладаў ўжыцця ў рэальным жыцці.