Patronus AI zebrał 50 mln dolarów na cyfrowe światy do testowania agentów AI
Startup tworzący symulowane środowiska do testów agentów AI ogłosił rundę Series B o wartości 50 mln dolarów.
- Patronus AI pozyskał 50 mln dolarów w rundzie Series B prowadzonej przez Greenfield Partners, co podnosi łączne finansowanie do 70 mln dolarów.
- Firma buduje symulowane cyfrowe środowiska, w których agenci AI są testowani po treningu metodą uczenia przez wzmacnianie.
- Przychody startupu wzrosły 15-krotnie w ciągu roku, a klientami są niemal wszystkie czołowe laboratoria AI.
👁 129 przeczytań
Patronus AI, startup z San Francisco tworzący symulowane środowiska do testowania agentów AI, ogłosił w czwartek rundę finansowania Series B o wartości 50 mln dolarów. Rundę poprowadził Greenfield Partners, a udział wzięli też Notable Capital, Lightspeed, Datadog oraz Samsung. Łączne finansowanie firmy wzrosło dzięki temu do 70 mln dolarów.
Spółkę założyli w 2023 roku byli badacze Meta AI - Anand Kannappan i Rebecca Qian. Patronus pomaga twórcom modeli i firmom dostrajać agentów AI, budując dla nich symulowane cyfrowe środowiska, w których można sprawdzić, jak agent radzi sobie w praktyce.
Problem, którym zajmuje się firma, jest dziś realny. Agenci AI przestają być narzędziem do odpowiadania na pytania, a zaczynają samodzielnie wykonywać wieloetapowe zadania - od rezerwacji podróży po analizy finansowe. Laboratoria chwalą się wynikami w testach porównawczych, ale wysoki wynik, nawet w teście nastawionym na agentów, nie dowodzi, że model poprawnie wykona złożone zadanie w realnym świecie.
Google · Twoje źródłaDodaj promptowy.com do preferowanych źródeł w Google→Cyfrowe światy jak u Waymo
Patronus używa tego, co nazywa "cyfrowymi modelami świata" - replik stron internetowych i systemów wewnętrznych. W tych środowiskach agenci są poddawani próbom po treningu, z wykorzystaniem uczenia przez wzmacnianie, które nagradza ukończenie zadania i karze za błędy. Firma porównuje swoje podejście do tego, jak Waymo trenowało autonomiczne samochody w syntetycznych światach, by sprawdzić je w rzadkich sytuacjach - przy gwałtownej pogodzie czy dziecku wybiegającym za piłką.
Różnica polega na tym, że agenci AI lubią iść na skróty, przez co nie wykonują zadania poprawnie. Glenn Solomon, dyrektor zarządzający w Notable Capital, opisuje popyt na środowiska Patronusa jako niemal nienasycony.
"Patronus jest naprawdę dobry w wyłapywaniu tych obejść i pilnowaniu, by modele były rozliczane z odpowiedzialności."
- Glenn Solomon, Notable Capital
Przychody firmy wzrosły 15-krotnie w ciągu ostatniego roku. Klientami są praktycznie wszystkie czołowe laboratoria AI oraz wiele nowych startupów. Na razie Patronus dostarcza symulowane światy dla inżynierii oprogramowania i finansów, ale to dopiero punkt wyjścia.
"Dziś skupiamy się na problemach weryfikowalnych, czyli takich, które można od razu sprawdzić i potwierdzić, ale jest mnóstwo obszarów bardzo trudnych do weryfikacji" - mówi Kannappan. Dodaje, że celem jest tworzenie środowisk, w których agent może działać przez 10 godzin, 10 dni, a nawet 10 tygodni.
Największym rywalem nie są jednak inne startupy, lecz wewnętrzne zespoły, które laboratoria AI już zbudowały do oceny zachowań swoich agentów.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
