Senior/Lead Automation Tester in Python (Agentic Memory Testing)
⚲ Poznan
16 000 - 27 000 PLN brutto (UoP)
Wymagania
- min. 3 lata doświadczenia w QA dla systemów AI/ML lub konwersacyjnych
- doświadczenie w testowaniu stanowych zachowań agentów (retencja kontekstu, personalizacja)
- doświadczenie w automatyzacji testów funkcjonalnych dla usług API-driven
- znajomość metodyk testowania regresyjnego
- angielski na poziomie min. B2
Mile widziane
- doświadczenie w testowaniu frameworków pamięci agentów (LangChain, LangGraph)
- doświadczenie w ewaluacji systemów konwersacyjnych AI
- znajomość testowania AWS AgentCore Memory oraz testów zgodności z GDPR (walidacja usuwania danych użytkownika)
Opis stanowiska
Dołączysz do zespołu budującego korporacyjną platformę do tworzenia i uruchamiania agentów AI na AWS, gdzie Twoim głównym obszarem będzie jakość działania pamięci agentów — zarówno krótkoterminowej (ciągłość w sesji), jak i długoterminowej (przywoływanie kontekstu między sesjami). W praktyce będziesz projektować i utrzymywać własne zestawy testów funkcjonalnych i regresyjnych w Pythonie, weryfikować poprawność ekstrakcji faktów i preferencji, cykl życia pamięci (TTL, usuwanie danych użytkownika, izolacja przestrzeni nazw) oraz to, czy pamięć nie pogarsza jakości odpowiedzi agenta. To oferta dla kogoś, kto ma już doświadczenie w testowaniu systemów AI/ML lub konwersacyjnych i chce pracować samodzielnie przy złożonym, produkcyjnym systemie. Uwaga: opis sugeruje, że będziesz odpowiedzialny(a) za całość testów pamięci agentów — może to oznaczać dużą autonomię, ale też ograniczone wsparcie zespołowe.
🔍 Dekoder Ogłoszenia
🔴
own functional and regression test suites for agentic memory behavior
Będziesz odpowiedzialny za całość testów związanych z pamięcią agentów, co może oznaczać dużą samodzielność, ale też brak wsparcia.
🟡
Enterprise Agent Development Platform — a production-grade, cloud-native ecosystem that enables engineering teams to define, orchestrate, deploy, and observe AI agents at scale.
Praca w złożonym, rozbudowanym systemie chmurowym, który może wymagać nauki wielu nowych technologii i narzędzi.
🔴
reducing agent development from months to days
Może sugerować presję na szybkie dostarczanie wyników i optymalizację procesów, co może prowadzić do stresu.
🟡
enforcing consistent security, quality, and governance standards
Oznacza ścisłe przestrzeganie procedur i standardów, co może ograniczać swobodę w podejmowaniu decyzji.
🟡
3+ years of experience in QA engineering for AI/ML or conversational AI systems
Wymagane jest specyficzne doświadczenie w obszarze AI/ML, co może być trudne do znalezienia na rynku pracy.