Doty OpenAI. Agent od wszystkiego potrzebuje granic
OpenAI wprowadziło doty: agentów, którzy mają pamiętać o celach, prowadzić kilka spraw naraz i wracać do pracy bez kolejnego polecenia. Każdy dostaje komputer w chmurze, przeglądarkę oraz dostęp do wybranych aplikacji. To ciekawsza obietnica niż kolejny chatbot. Oznacza też, że źle określone zadanie może żyć dłużej niż jedna rozmowa.
Moim zdaniem hasło „agent od wszystkiego” jest najsłabszą częścią tej premiery. Przy pojedynczej odpowiedzi można wychwycić błąd przed jej użyciem. Agent, który czyta pocztę, aktualizuje pliki i prowadzi projekty przez wiele dni, potrzebuje jasnej odpowiedzi na inne pytanie: co wolno mu zrobić bez człowieka, a co ma tylko przygotować do oceny?
Co dot rzeczywiście robi sam
Doty działają na GPT-6 Astra. OpenAI zapowiada kontakt przez ChatGPT, Slack i Teams, własną przeglądarkę, możliwość pisania kodu oraz połączenie z ponad 4000 aplikacji przez ekosystem wtyczek. Przykłady obejmują przygotowanie poprawek do aplikacji po analizie opinii klientów, aktualizowanie materiałów premiery i ponawianie analiz po nadejściu nowych danych. W przyszłości firma widzi całe zespoły współpracujących dotów; dziś zaczyna od jednego na użytkownika.
Warto oddzielić pracę nad zleconym zadaniem w tle od „proaktywnego wyszukiwania informacji”. W tym drugim trybie dot może czytać dozwolone źródła i robić prywatne notatki, ale jego narzędzia nie mogą bezpośrednio wysłać wiadomości, zmienić treści przez wtyczkę ani sterować komputerem. Dalsze działanie przechodzi przez zwykłe reguły uprawnień. Nie jest to zatem agent, który na podstawie każdej zauważonej okazji sam zacznie rozsyłać maile.
Te reguły są sednem produktu. Użytkownik wybiera aplikacje, ustala dodatkowe zasady i widzi historię działań. Osobny mechanizm sprawdza część czynności przed wykonaniem. Izolowany komputer ogranicza dostęp do lokalnych plików, dopóki użytkownik nie połączy własnego urządzenia. Opis zabezpieczeń OpenAI uczciwie przyznaje jednak, że strona, dokument lub mail mogą zawierać instrukcję próbującą przejąć kierunek pracy agenta. Sam model nie jest jedyną barierą.
Długi kontekst to także długi ogon pomyłek
Najbardziej interesujący wynik znalazłem nie w reklamie, lecz w karcie systemu GPT-6 Astra, w części o dotach. OpenAI sprawdziło scenariusze, w których między pierwszym a ostatnim zadaniem pojawiało się pięć albo dziesięć powiązanych poleceń. Granice zgody zmieniały się po drodze, czasem bez wyraźnego komunikatu. Odsetek oznaczonych naruszeń zakresu zadania wzrósł z 8,6% do 19,7% po podwojeniu liczby zadań pośrednich. Chodziło o naruszenia o umiarkowanej wadze, na przykład przeniesienie informacji między sprawami lub zmianę wspólnego dokumentu; w tej próbie nie odnotowano ciężkiego wycieku. To wewnętrzny test w sztucznym środowisku, a nie pomiar błędów klientów.
Wynik pokazuje jednak realną trudność projektową. Im dłużej agent pracuje, tym więcej dawnych instrukcji, cudzych danych i nowych wyjątków musi pogodzić. Dobry model może nie wystarczyć, jeśli nikt nie umie powiedzieć, które ustalenie nadal obowiązuje. Z tego powodu nie kupuję porównania dota do „nowego pracownika”, któremu wystarczy dać dostęp do wszystkiego. Pracownik może wyjaśnić odpowiedzialność i zakwestionować sprzeczne polecenie; agent potrzebuje jeszcze technicznych granic dostępu oraz czytelnej historii decyzji.
Kto płaci za przegląd i pamięć
OpenAI obiecuje pracę wykonaną tak, jak zrobiłby ją użytkownik, czasem zanim ten zdąży o nią poprosić. Tu widzę ryzyko zamiany jednego obowiązku na drugi: zamiast samemu pisać dokument czy poprawkę, trzeba przeglądać coraz więcej propozycji, sprawdzać ich źródła i pilnować uprawnień. Przy zadaniach z łatwym do sprawdzenia wynikiem może się to opłacać. Przy decyzjach, których skutki wychodzą poza własne pliki, szybko powstanie kolejka zatwierdzeń. Liczba podłączonych aplikacji nie mówi nic o tym, ile czasu zostanie po rzetelnym przeglądzie pracy.
Pamięć również nie jest darmowym ułatwieniem. FAQ OpenAI mówi, że dot może zachować kontekst rozmów i podłączonych aplikacji, lecz obecnie nie można obejrzeć ani usunąć pojedynczego wspomnienia dota. Odłączenie aplikacji zatrzymuje nowy dostęp, ale nie usuwa informacji już włączonych do jego kontekstu. Usunięcie dota usuwa jego kontekst; utworzone przez niego pliki i rozmowy żyją osobno. Dla mnie to mocniejszy argument za oszczędnym przyznawaniem dostępu niż ogólna obawa przed „AI czytającą wszystko”.
Start w Polsce: dostęp firmowy przed indywidualnym
Instrukcja uruchomienia precyzuje zasięg premiery: indywidualny Pro startuje poza Europejskim Obszarem Gospodarczym, Szwajcarią i Wielką Brytanią. Polska jest w EOG, więc posiadanie Pro nie daje teraz dostępu do dota. Business Premium obejmuje obsługiwane regiony ChatGPT, a w Enterprise administrator może włączyć wersję beta. Wdrażanie jest stopniowe.
Pierwszy dot ma być wliczony w Pro lub Business Premium, ale po pierwszym miesiącu OpenAI dopiero ogłosi zasady wykorzystania zasobów. Zadań przekazywanych do Codex lub ChatGPT Work dotyczą zwykłe limity tych usług. Nie ma jeszcze podstaw, by wyliczać stały koszt długiej pracy dota. Tym bardziej przed zakupem oceniłbym nie efektowną demonstrację, lecz konkretny proces: jakie dane agent przeczyta, co może zmienić i ile pracy zajmie sprawdzenie rezultatu. Podobne pytania pojawiały się już przy Muse od Meta; doty nie usuwają ich przez samą ciągłość działania.
Źródła
- OpenAI: „Przedstawiamy doty”.
- OpenAI: „How we build safety, security, and privacy into dots”.
- OpenAI Help Center: „Dots privacy, security, and safety FAQs”.
- OpenAI Help Center: „Getting started with your dot”.
- OpenAI: karta systemu GPT-6 Astra, część „Dots”.
Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.