Sari la conținut
Toate articolele
Cu AI în cloud

Costuri AI imposibil de prevăzut. Cloud-ul e mai ieftin, și nu asta e problema.

Facturarea per token este ieftină la volumul de azi. Linia pe care finanțele nu o pot scrie este cea de anul viitor, pentru că prețul, volumul și modelul se mișcă toate după programul furnizorului.

6 min de citit

Începem cu concesia, pentru că un director financiar o va găsi oricum. La volum interactiv obișnuit, AI-ul din cloud este mai ieftin decât orice cutie din clădirea ta. O echipă care discută cu un asistent câteva ore pe zi costă câteva sute de euro pe lună în tokeni. Nimeni nu ar trebui să pretindă altceva.

Problema nu este mărimea facturii. Este că trei variabile din factură sunt în afara controlului tău și se schimbă fără semnătura ta.

Variabila unu: prețul

La 30 iunie 2026 Anthropic a lansat Claude Sonnet 5 și a scris că modelul costă 2 dolari per milion de tokeni de intrare și 10 dolari per milion de tokeni de ieșire. Aceeași postare l-a numit preț introductiv, cu o creștere la 3 și 15 dolari programată pentru 1 septembrie. La 10 august postarea a fost editată: prețul introductiv „este acum permanent”.

Acesta este un furnizor care se comportă bine. A anunțat creșterea cu săptămâni înainte, apoi a ales să nu o aplice. Este, în același timp, o oscilație de 50 % într-o linie de buget, decisă de două ori în zece săptămâni, la San Francisco. O echipă financiară din Cluj a citit despre ambele decizii după ce au fost luate.

Variabila doi: volumul

Facturarea per token înseamnă că factura urmează adopția. Un calcul, ca să îl poți verifica: o echipă de 50 de oameni la 100 de milioane de tokeni pe lună folosește circa 95.000 de tokeni de persoană pe zi lucrătoare, adică aproximativ 24 de schimburi consistente de 4.000 de tokeni. La 2 și 10 dolari per milion de tokeni, cu 80 % din trafic ca intrare, luna aceea costă circa 360 de dolari, adică aproximativ 330 de euro.

Acum echipa devine bună la asta. Agenții redactează, revizuiesc și re-redactează fără ca cineva să tasteze fiecare schimb. Aceeași aritmetică la un volum de zece ori mai mare înseamnă o factură de zece ori mai mare, iar linia financiară care era 330 de euro devine 3.300 de euro, în același trimestru, fără nicio comandă de achiziție. O linie care se dublează când o echipă devine productivă este o linie pe care nimeni nu o poate bugeta.

Variabila trei: modelul

Modelul pe care l-ai prețuit nu este modelul pe care îl vei rula. Furnizorii retrag modele după propriul calendar. Centrul de ajutor OpenAI consemnează că ChatGPT a retras GPT-4o, GPT-4.1, GPT-4.1 mini și o4-mini la 13 februarie 2026, iar pagina de deprecieri a API-ului listează eliminarea snapshot-ului chatgpt-4o-latest la 17 februarie 2026. Fiecare retragere îți mută traficul pe un model cu alt preț și alt comportament, iar prompturile, testele și materialele tale de instruire îl urmează.

Factura din cloud nu este scumpă. Este a nimănui. Trei oameni pe care nu i-ai întâlnit niciodată o stabilesc, și fiecare dintre ei își face bine treaba.

Unde se întoarce aritmetica

O taxă lunară fixă este o afacere proastă pentru o echipă care conversează și una bună pentru o echipă care automatizează. Calculul nostru pune pragul de egalitate pentru o cutie Reasoning, față de un model de top din cloud, la aproximativ 400.000 de tokeni de utilizator pe zi lucrătoare. Acela este volum de agenți și de procesare de documente, nu de conversație. Sub el, cloud-ul câștigă la preț. Peste el, taxa fixă câștigă, și câștigă mai mult cu fiecare lună în care adopția crește.

Cu Bastion

Ce schimbă Bastion

Bastion este o singură taxă lunară pentru o cutie care deservește echipa ta. Taxa acoperă hardware-ul, actualizările de model și suportul, și nu se mișcă atunci când utilizarea o face. Modelul de pe cutie se schimbă doar când accepți actualizarea, pentru că nimic de pe cutie nu sună acasă.

Limita, spusă întâi: dacă echipa ta folosește AI-ul pentru conversație obișnuită la volum obișnuit, cloud-ul este mai ieftin și va rămâne mai ieftin. Bastion se cumpără pentru celelalte două motive de pe acest site, unde ajung datele și cine ține întrerupătorul. Argumentul de cost începe doar la volum de automatizare.

Sursele

  1. 1

    Anthropic

    Introducing Claude Sonnet 5

    citit

  2. 2

    OpenAI Help Center

    Retiring GPT-4o and other ChatGPT models

    citit

  3. 3

    OpenAI Developers

    Deprecations

    citit