Część 2: Microsoft, koszty i cztery wnioski praktyczne
Pierwsza część tego podsumowania dotyczyła trzech dostawców - Anthropica, OpenAI i Google - oraz zmiany, która w 2026 roku przeszła przez wszystkich jednocześnie: asystent przestał odpowiadać na pytania i zaczął wykonywać zadania. Anthropic nazwał to Cowork, OpenAI ChatGPT Work, Google Gemini Spark. Najciekawsza liczba z tamtej części dotyczyła tego, kto z tych narzędzi realnie korzysta: w ponad 600 tysiącach organizacji jedna trzecia sesji dotyczyła procesów biznesowych, a tylko niecałe 9% programowania. Narzędzia kojarzone z działami IT trafiły do księgowości, operacji, sprzedaży i marketingu.
Ta część zamyka obraz. Zaczynamy od Microsoftu, bo dla większości polskich firm to najkrótsza droga do AI - Copilot jest tam, gdzie już są ich dane - a jednocześnie dostawca, u którego w tym roku najbardziej zmieniły się zasady płacenia. Potem wracamy do kosztów, bo to jedyny temat, w którym powszechna opinia rozmija się z cennikami: nie jest prawdą, że modele po prostu tanieją. Na koniec cztery wnioski, które da się wdrożyć w firmie bez działu IT - łącznie z tym, czego lepiej nie robić.
Dla porządku: wszystkie ceny podaję w USD, za milion tokenów, w układzie wejście/wyjście, czyli osobno za tekst wysłany do modelu i osobno za tekst, który model zwraca. Ten drugi jest zawsze wielokrotnie droższy.
1. Microsoft i Copilot: najwygodniejsze wejście, najtrudniejszy budżet
Microsoft ma najprostszą drogę do polskiej firmy - Copilot jest tam, gdzie już są Państwa dane. I w 2026 roku ta droga stała się tańsza: od 1 lipca dostępne są stałe pakiety Business Standard with Copilot za 23,50 USD i Business Premium with Copilot za 32 USD za użytkownika miesięcznie, a do 31 grudnia 2026 obowiązuje promocja na samodzielnego Copilota Business za 18 USD. To wyraźnie mniej niż dokładanie Copilota do starej subskrypcji. Jednocześnie od 1 lipca podniesiono ceny samych pakietów: Office 365 E3 o 13%, Microsoft 365 E3 o 8%, Business Standard o 12%, a plany dla pracowników pierwszej linii F1 i F3 odpowiednio o 33% i 25%.
Funkcjonalnie Copilot przestał być czatem. Agent Mode w Wordzie, Excelu i PowerPoincie stał się domyślnym doświadczeniem. Copilot Notebooks generują dokumenty, arkusze i prezentacje oraz mapy myśli. Agentów można harmonogramować i publikować w firmowym Agent Store (od 15 lipca). Doszła też rzecz, która jeszcze rok temu byłaby nie do pomyślenia: w Copilocie można wybrać model Anthropica - Claude działa w Excelu i PowerPoincie, a od czerwca jest dostępny jako opcja w Copilot Chat.
Po stronie deweloperskiej GitHub Copilot przeszedł od 1 czerwca na rozliczenie zużyciowe (GitHub AI Credits liczone od tokenów), z planami Pro za 10 USD, Pro+ za 39 USD i nowym Max za 100 USD. Uzupełnianie kodu nie zużywa kredytów, ale zniknął automatyczny fallback do tańszego modelu - w komunikacie GitHuba wprost: „Fallback experiences will no longer be available”. Tam, gdzie wcześniej po wyczerpaniu limitu praca schodziła na tańszy model, dziś praca po prostu zaczyna kosztować.
I tu jest największa zmiana, którą trzeba zrozumieć przed podpisaniem czegokolwiek: budżet na Copilota przestał być przewidywalny. Do 2025 roku płaciło się ustaloną kwotę za użytkownika i to było wszystko. Od 2026 roku są dwa strumienie: licencja plus Copilot Credits zużywane przez Cowork, Work IQ i agentów. Rozliczanie Cowork weszło w życie 1 lipca. Bez ustawionych limitów wydatków na poziomie organizacji, grupy i użytkownika oraz bez pilnowania panelu kosztów można dostać fakturę, której nikt nie planował. To samo dotyczy GitHuba.
Do tego dwie kwestie zgodności, ważne szczególnie dla firm z sektora regulowanego. Po pierwsze, modele Anthropica w Microsoft 365 są przetwarzane poza granicą danych UE (EU Data Boundary) - Anthropic działa jako subprocesor Microsoftu. Po drugie, według komunikatu administracyjnego z kwietnia (MC1269223, informacja podawana zgodnie przez kilka źródeł branżowych, ale nieobecna w oficjalnej dokumentacji Microsoftu) uruchomiono mechanizm Flex Routing, według tych doniesień domyślnie włączony, który przy dużym obciążeniu infrastruktury europejskiej może kierować przetwarzanie zapytań poza EUDB. Dane w spoczynku pozostają w Europie. Jeśli Państwa firma ma wymogi rezydencji danych, to jest ustawienie, które należy świadomie sprawdzić i udokumentować, a nie zakładać.
Ostatnia rzecz, o której warto wiedzieć, planując wdrożenie: Microsoft podał około 30 mln płatnych stanowisk Copilota na koniec czerwca. Jednocześnie w prasie branżowej opisano wewnętrzne notatki wskazujące, że za Copilota płaci poniżej 4,5% komercyjnych użytkowników Microsoft 365, a spośród nich tylko 20–30% korzysta z niego co tydzień. To informacja nieoficjalna, ale spójna z tym, co słyszy się od firm: samo kupienie licencji nie generuje żadnego zwrotu.
2. Koszty: szczyt oferty w górę, dolna półka w dół
Najczęściej powtarzana teza o AI w 2026 roku brzmi: „modele tanieją”. W tej ogólnej postaci jest nieprawdziwa, a dla firmy planującej budżet - myląca. Ceny rozjechały się w dwie strony i kierunek zależy od tego, o którą półkę oferty pytamy.
Na szczycie oferty jest drożej. Najmocniejszy model OpenAI kosztował na początku roku 1,75/14 USD za milion tokenów (GPT-5.2). Dziś szczytem jest GPT-6 Astra z 3 września: 10/50 USD, a przy długim kontekście 20/75. Wejście flagowego modelu podrożało więc od stycznia do września blisko sześciokrotnie. Anthropic ceny Opusa nie ruszył - stoi na 5/25 USD od listopada 2025 - ale dostawił nad nim nowe piętro, Fable 5 i Mythos 5 po 10/50 USD. Dla firmy skutek jest podobny: „najlepszy dostępny model” kosztuje dziś u obu dostawców 10/50 USD - u Anthropica dwa razy więcej niż w styczniu, u OpenAI blisko sześć razy więcej na wejściu. Wyjątkiem jest Google, u którego Gemini 3.1 Pro utrzymał cenę poprzednika, 2/12 USD.
Na dolnej półce jest taniej - ale nie u wszystkich. OpenAI obniżyło 30 lipca cenę modelu Luna o 80%, do 0,20/1,20 USD, a Terry o 20%, do 2/12. Anthropic zszedł Sonnetem z 3/15 do 2/10. U Google stało się odwrotnie: linia Flash, czyli ta ekonomiczna, w ciągu roku podrożała pięciokrotnie na wejściu - z 0,30/2,50 (Gemini 2.5 Flash) do 1,50/9,00 (Gemini 3.5 Flash) - a promocja na Gemini 3.7 Flash kończy się 31 grudnia.

Rys. 1. Zmiana ceny w dwóch segmentach oferty w 2026 roku, w USD za milion tokenów wyjściowych. Każdy odcinek prowadzi od modelu z początku okresu do jego dzisiejszego odpowiednika. Ceny katalogowe producentów. * dla Gemini 3.7 Flash podano stawkę obowiązującą od 1 stycznia 2027, po wygaśnięciu promocji - dziś jest to 3,75 USD.
Rachunek to jednak nie cennik. Trzy mechanizmy podnoszą koszt zadania niezależnie od stawki. Pierwszy: tokeny rozumowania - te, które model zużywa „na myślenie” - są rozliczane jak tokeny wyjściowe, czyli po najwyższej stawce; OpenAI zaleca rezerwowanie na nie co najmniej 25 tys. tokenów na zapytanie. Drugi: praca agentowa to nie jedno zapytanie, lecz pętla kilkudziesięciu wywołań na jedno zlecenie. Trzeci: zniknęły tanie zabezpieczenia - GitHub usunął automatyczne przejście na tańszy model, a Microsoft i GitHub przeszły na rozliczenie kredytowe, w którym nie ma górnego pułapu, dopóki się go samemu nie ustawi.
Uczciwie trzeba dodać drugą stronę: dostawcy twierdzą, że nowsze modele są tokenowo oszczędniejsze, i podają na to liczby - Anthropic, że Opus 5 potrzebuje około siedmiokrotnie mniej tokenów rozumowania niż Opus 4.8. Obie obserwacje są prawdziwe i razem prowadzą do tego samego wniosku: różnice między modelami są dziś tak duże, że o rachunku decyduje dobór modelu do zadania, a nie moment zakupu.

Rys. 2. Rozrzut cen katalogowych API, wrzesień 2026, w USD za milion tokenów wyjściowych. Najdroższy i najtańszy model różnią się około czterdziestokrotnie. Microsoft nie rozlicza Copilota za tokeny - obowiązuje model licencji i kredytów, dlatego nie ma go na wykresie.
3. Wnioski praktyczne
Oszczędność jest w doborze modelu, nie w czekaniu na spadek cen. Między najtańszym a najdroższym modelem na rynku różnica jest czterdziestokrotna, a większość codziennych zadań firmowych - segregacja korespondencji, wstępna kwalifikacja zapytań, streszczanie dokumentacji, kontrola kompletności faktur - wykonuje się na dolnej półce równie dobrze jak na górnej. Model najwyższej klasy ma sens tam, gdzie faktycznie decyduje jakość rozumowania: analiza umowy, przygotowanie oferty, praca na sprzecznych danych.
Przypisanie modeli do zadań to wyzwanie, nie oczywistość. Przypisanie modeli do zadań trzeba wykonać samemu, a warunki zmieniają się co kilka tygodni: lista modeli jest przebudowywana kilka razy w roku, tańsze zabezpieczenia zniknęły, a rozliczenie kredytowe nie ma naturalnego pułapu. W praktyce oznacza to cztery rzeczy: spisać, które zadania idą na który model; ustawić limity wydatków na poziomie organizacji i użytkownika; mierzyć koszt na wykonane zadanie, a nie cenę za token; i przeglądać te przypisania raz na kwartał, bo model, na którym dziś stoi proces, za rok najprawdopodobniej nie będzie dostępny.
Pilotaż na pięciu osobach, nie licencja dla wszystkich. Wszystkie dostępne dane o adopcji mówią to samo: liczba licencji nie ma nic wspólnego z efektem. Sensowna kolejność to wybór dwóch–trzech konkretnych, powtarzalnych procesów, zmierzenie czasu przed i po, a dopiero potem skalowanie. Modele cenowe wprost to wspierają - ChatGPT Business ze zróżnicowanymi stanowiskami, Claude z planami od około 20 USD, Microsoft z pakietami Business.
Zgodność wymaga decyzji, nie ustawień domyślnych. Trzy konkretne punkty do sprawdzenia: Claude nie ma dziś europejskiej rezydencji danych dla modeli (przetwarzanie może odbywać się w USA); modele Anthropica w Microsoft 365 działają poza granicą danych UE; Flex Routing w Copilocie jest prawdopodobnie włączony domyślnie w Państwa tenancie. Google oferuje najdalej idącą kontrolę - od kwietnia można zamknąć przetwarzanie i przechowywanie danych AI w Unii oraz stosować szyfrowanie po stronie klienta. Osobno: od 2 sierpnia 2026 Komisja Europejska ma pełne uprawnienia egzekucyjne wobec dostawców modeli ogólnego przeznaczenia w ramach AI Act, z karami do 3% globalnego obrotu. Dokumentacja dostawcy i własna ocena ryzyka przestały być formalnością.
Dług techniczny to koszt planowany, nie niespodzianka. Od początku roku wyłączono: u OpenAI całą rodzinę GPT-4o, GPT-4.1 i o3 oraz produkty Sora, Atlas i Pulse; u Google Gemini 2.0 Flash, starsze modele Veo i Imagen 4, a od 21 lipca wycofano podstawowe parametry API; u Anthropica modele Opus 4 i Sonnet 4; w GitHub Copilocie od 1 września znikają kolejne modele. Każda integracja zbudowana w 2025 roku wymaga dziś przeglądu, a każda budowana teraz - założenia, że model, na którym stoi, zniknie w ciągu roku.
Artykuł opracowano na podstawie oficjalnych komunikatów Anthropica, OpenAI, Google i Microsoftu oraz doniesień prasy branżowej z okresu styczeń–początek września 2026. Informacje oznaczone w tekście jako nieoficjalne lub prasowe nie zostały potwierdzone przez producentów. Podane ceny są cenami katalogowymi w USD dla rynku amerykańskiego i mogą różnić się od cen dla Polski.



