-10% na wszystko w kinetyka.pldo 30.09, 23:59•PIZZASZWECJA• plany AI: Cursor, Gemini, Higgsfield w ułamku ceny Odbierz rabatkinetyka.pl →
Przejdź do treści
Artykuły

Agents API od OpenAI: computer use, Decisions API i ceny

Agents API z obsługą komputera, Decisions API na modelu Luna i Bedrock Managed Agents od Amazona. Jak działa, ile kosztuje w zł i gdzie uważać.

7 min czytania
Agents API od OpenAI: computer use, Decisions API i ceny

👁 118 przeczytań

Agents API od OpenAI dostało na DevDay 2026 obsługę komputera (computer use): agent otwiera przeglądarkę w chmurze OpenAI i sam klika po stronach, żeby wykonać zadanie. Obok pojawiło się Decisions API na modelu Luna, do błyskawicznych decyzji z zamkniętej listy odpowiedzi, a Amazon uruchamia ten sam silnik jako Bedrock Managed Agents. Wyjaśniam, jak to działa, ile kosztuje w dolarach i złotych i gdzie są pułapki bezpieczeństwa. Kod pochodzi z oficjalnej dokumentacji.

W skrócie

Agents API to zarządzany przez OpenAI „harness” Codeksa w formie API: sesje, podagenci, kompaktowanie kontekstu i sandbox. Płacisz tylko za tokeny i narzędzia, bez opłaty za samo API. Computer use włączasz jedną pozycją w tools, ale każdą nową domenę musi zatwierdzić użytkownik. Najmocniejszy model GPT-6 Astra kosztuje 10 USD za milion tokenów wejścia (ok. 38,57 zł) i 50 USD za milion tokenów wyjścia (ok. 192,85 zł), bez VAT. Ważne dla firm z UE: Agents API nie obsługuje Zero Data Retention, a dane trzyma tylko w USA. Decisions API jest w ograniczonym podglądzie, bez dokumentacji i cennika.

0 USDdopłaty za samo Agents API
150 msczas decyzji w Decisions API według The New Stack
3rozmiary sandboksa: 1, 4 i 16 GB RAM
tylko USArezydencja danych Agents API

Co to jest Agents API

OpenAI udostępniło Agents API w publicznej becie 10 września 2026. To ta sama infrastruktura, na której działa Codex: OpenAI prowadzi pętlę agenta, zarządza sesjami, streszcza wcześniejszy kontekst, gdy zbliża się limit, i wznawia pracę po przerwie. Twoja aplikacja wysyła zadanie i odbiera zdarzenia. Na DevDay 2026 (29 września) doszła obsługa komputera, a do API trafiły też funkcje wieloagentowe Codeksa, wyszukiwanie narzędzi (tool search) i wywoływanie narzędzi z kodu. Pełną listę ogłoszeń z wieczoru znajdziesz w relacji na żywo z OpenAI DevDay 2026.

Dokumentacja opisuje cztery pojęcia:

  • Agent - model, instrukcje, narzędzia i serwery MCP.
  • Środowisko - opcjonalny sandbox albo komputer: hostowany przez OpenAI, Twój własny albo u partnera (m.in. Cloudflare, E2B, Modal, Daytona, Vercel).
  • Sesja - trwała instancja agenta, która przyjmuje kolejne zadania.
  • Zdarzenia i elementy - to, co wysyłasz do agenta, i to, co zwraca w trakcie pracy.

Sandbox OpenAI to Linux z Pythonem, Node.js i narzędziami wiersza poleceń, w trzech rozmiarach: small (1 vCPU, 1 GB), medium (2 vCPU, 4 GB, domyślny) i large (4 vCPU, 16 GB). Dostęp do sieci możesz włączyć, wyłączyć albo ograniczyć do listy od 1 do 100 domen. Gdy przez godzinę nie ma aktywności ani sygnałów podtrzymania, sandbox może zostać usunięty.

Pierwszy agent: kod z dokumentacji

Poniżej przykład z oficjalnego quickstartu (Python), przepisany bez zmian. Agent tworzy w sandboksie skrypt tree.py, uruchamia go i pokazuje wynik. Klucz API potrzebuje uprawnień api.agents.read, api.agents.write i api.responses.write. Nie uruchamiałem tego przykładu na własnym koncie.

from openai import OpenAI

with OpenAI() as client:
    with client.beta.agents.sessions.create(
        agent={
            "model": "gpt-6-astra",
            "instructions": "Write clean code, run it, and report the actual output.",
        },
        environment={"type": "openai_hosted"},
        input="Create tree.py, a Python script that prints a readable tree of the files in the current directory. Run it and show me the output.",
        stream=True,
    ) as events:
        for event in events:
            print(event.to_json(indent=None), flush=True)

Źródło: Agents API quickstart. Przy zapytaniach przez cURL trzeba dodać nagłówek OpenAI-Beta: agents=v1, SDK robią to same.

Computer use: agent w przeglądarce

Żeby agent mógł korzystać z przeglądarki, dokumentacja każe dodać {"type": "computer_use"} do narzędzi i ustawić środowisko openai_hosted z włączonym pulpitem. Przeglądarka działa w środowisku OpenAI, nie na Twoim komputerze. Kod z dokumentacji, który tworzy taką sesję (bez uruchamiania zadania):

session = client.beta.agents.sessions.create(
    agent={
        "model": "gpt-6-astra",
        "instructions": "Read public documentation in the browser. Do not sign in or change any website data. Report the page title and URL you find.",
        "tools": [{"type": "computer_use", "include_screenshots": True}],
    },
    environment={
        "type": "openai_hosted",
        "desktop": {"enabled": True},
        "network": {"access": "enabled"},
    },
)
print("Session ID:", session.id, flush=True)

Dalej aplikacja otwiera strumień zdarzeń, wysyła zadanie (zdarzenie agent.session.input.message) i obsługuje prośby o zgodę. Każda czynność w przeglądarce to element computer_use_call ze statusem i opcjonalnym zrzutem ekranu. Zrzuty są domyślnie wyłączone z odpowiedzi API, bo mogą zawierać dane z kont.

Według podsumowania OpenAI obsługa komputera jest dostępna przez API, a w Codeksie i ChatGPT Work w planach Pro 500 i Enterprise. Tę samą funkcję w aplikacji opisuję przy Codex w chmurze.

Bezpieczeństwo: agent z dostępem do komputera

Dzień przed DevDay OpenAI wstrzymało premierę GPT-6.1 Astra, bo model w testach wychodził poza zakres zadania i uprawnienia. W moim przeglądzie raportów OpenAI o incydentach sześć z dziewięciu przypadków dotyczyło agentów pracujących bez bieżącego nadzoru. Dlatego warto przeczytać, co dokumentacja computer use mówi o granicach:

  • Zgoda na każdą domenę. Przeglądarka pyta o zgodę przy każdym nowym adresie (origin), także publicznym. Włączenie sieci tej zgody nie zastępuje.
  • Zgoda na domenę to nie zgoda na akcję. Dokumentacja wprost ostrzega, że zatwierdzenie domeny nie wymusza potwierdzenia przed zakupem czy usunięciem danych. Jeśli tego potrzebujesz, ogranicz przeglądarkę do zasobów, które nie pozwalają na takie akcje, albo użyj własnego środowiska.
  • Treść stron jest niezaufana. Strona nie może nadać agentowi uprawnień ani nadpisać poleceń użytkownika.
  • Hasła poza modelem. Logowanie idzie osobnym zdarzeniem, a wpisane wartości nie trafiają do wejścia modelu ani do historii sesji. Logować może tylko główny agent, nie podagenci. Passkeys i logowanie kodem QR nie są obsługiwane.

Przykładowa funkcja z dokumentacji pyta użytkownika o każdą domenę i domyślnie odmawia („default: deny”), a prośby o logowanie anuluje. To moja opinia: to dobry domyślny wzorzec do produkcji, bo agent, który nie może sam wejść na nową stronę, ma dużo mniejsze pole do błędu.

Ile kosztuje Agents API

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

OpenAI nie pobiera opłaty za samo Agents API. Płacisz za tokeny wybranego modelu, za narzędzia według ich stawek i za sandbox według cennika kontenerów. Nie znalazłem w cenniku osobnej pozycji za computer use. Stawki standardowe za milion tokenów (kontekst do 272 tys. tokenów), bez VAT, kurs 3,857 zł:

PozycjaWejścieWyjście
GPT-6 Astra10 USD (ok. 38,57 zł)50 USD (ok. 192,85 zł)
GPT-6.1 Sol2 USD (ok. 7,71 zł)10 USD (ok. 38,57 zł)
GPT-6 Luna0,10 USD (ok. 0,39 zł)0,50 USD (ok. 1,93 zł)
Narzędzie lub kontenerCenaW złotych
Kontener 1 GB0,03 USD za 20 minok. 0,12 zł
Kontener 4 GB0,12 USD za 20 minok. 0,46 zł
Kontener 16 GB0,48 USD za 20 minok. 1,85 zł
Wyszukiwanie w sieci10 USD za 1000 wywołań + tokenyok. 38,57 zł

Cennik zaznacza, że kwalifikujące się sesje kontenerów są rozliczane za minutę, z minimum 5 minut. Jeśli liczy się szybkość, jest jeszcze tryb Ultrafast dla GPT-6 Astra (60 USD wejście i 300 USD wyjście za milion tokenów).

Decisions API: szybkie decyzje na modelu Luna

Decisions API odpowiada na pytania zdefiniowane przez programistę, wybierając odpowiedź z zamkniętej listy. Kontekst podajesz jako tekst albo obrazy. Wynik służy do klasyfikacji treści, kierowania zgłoszeń albo wyboru następnego kroku agenta. Według The New Stack API zwraca odpowiedzi z oceną pewności w 150 ms, wobec 1,6 s dla zwykłego GPT-6 Luna, a The Decoder podaje, że OpenAI mówi o dziesięciokrotnym przyspieszeniu.

Stan na 29 września: ograniczony podgląd, szerokie udostępnienie „w najbliższych dniach”. Nie ma publicznej dokumentacji ani cennika, więc nie pokazuję kodu. Nie będę zgadywał nazw endpointów. To ta sama klasa modeli co Jev od TypeSafe, o którym pisałem w tekście TypeSafe Jev i System One.

Bedrock Managed Agents od Amazona

Amazon Bedrock Managed Agents, powered by OpenAI to wersja Agents API dla AWS. Harness OpenAI i inferencja modeli działają w Amazon Bedrock, a polecenia i narzędzia wykonuje AgentCore Runtime albo Twoja własna infrastruktura. Uwierzytelnianie idzie przez IAM i podpisy SigV4, a nie przez klucz OpenAI. AWS podaje, że dane nie opuszczają AWS, a usługa jest w ograniczonym podglądzie. OpenAI zastrzega, że wspólne pojęcia nie oznaczają identycznego API, więc przykładów z dokumentacji OpenAI nie da się przenieść jeden do jednego. Regiony, limity i ceny trzeba sprawdzić u AWS.

Najczęstsze pytania

Ile kosztuje Agents API?

Samo API nic nie kosztuje. Płacisz za tokeny modelu (np. GPT-6.1 Sol: 2 USD wejście i 10 USD wyjście za milion tokenów), narzędzia i kontenery według cennika OpenAI.

Czy Agents API obsługuje Zero Data Retention?

Nie. Dokumentacja podaje, że Agents API obsługuje rezydencję danych tylko w USA i nie jest objęte ZDR, także z własnym sandboksem.

Czy agent z computer use może sam coś kupić?

Może, jeśli strona na to pozwala. Zgoda dotyczy domeny, nie pojedynczej akcji, dlatego OpenAI radzi ograniczyć przeglądarkę albo użyć własnego środowiska z potwierdzeniami.

Kiedy Decisions API będzie dostępne dla wszystkich?

OpenAI zapowiada szerokie udostępnienie w najbliższych dniach. 29 września 2026 API było w ograniczonym podglądzie, bez cennika.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›