Codex pe AWS Bedrock are un bug care îți dublează factura — ce s-a întâmplat și cum te protejezi
Un bug în integrarea Codex pe AWS Bedrock a cauzat taxiri de 10x mai mari decât se aștepta. Explicăm ce s-a întâmplat, cum afectează utilizatorii și ce pași poți face pentru a-ți proteja costurile.
Ce vei găsi în acest articol:
- Ce s-a întâmplat cu Codex pe AWS Bedrock și de ce facturile au crescut de 10x
- Cum funcționează calculul costurilor la modelele AI prin AWS Bedrock
- Ce pași concreți poți face acum pentru a verifica și limita costurile
- Alternative mai sigure pentru rularea Codex în producție
- Checklist de urgență pentru cei care folosesc AWS Bedrock
Ce s-a întâmplat?
Pe data de 21 august 2026, pe Hacker News a apărut un story care a alarmat comunitatea de developeri: Codex, agentul de programare de la OpenAI, rulează pe AWS Bedrock cu un bug serios care duce la taxiri de 10x mai mari decât utilizatorii se așteaptă.
Problema a fost raportată pe GitHub (issue #37674 din repo-ul OpenAI/Codex) și a adus rapid peste 120 de voturi și zeci de comentarii de la utilizatori afectații. Nu e vorba de un caz izolat — mai mulți developeri și companii care rulează Codex prin AWS Bedrock au primit facturi mult mai mari decât bugetul alocat.
De ce e grav? Pentru că Codex e un agent AI care scrie cod interactiv. El rulează comenzi, citește fișiere, testează soluții — și fiecare interacțiune consumă tokeni. Când ai un bug de monitoring sau de calcul al costurilor, poți ajunge să plătești zeci de mii de dolari fără să faci nimic diferit de obicei.
Cum funcționează costurile la modelele AI prin AWS Bedrock
AWS Bedrock e serviciul Amazon care îți permite să folosești modele AI de la diferiți furnizori (Anthropic, OpenAI, Meta, etc.) prin API, fără să-ți găzduiești propriul hardware. Plata e pe tokeni — cuvinte procesate și generate.
Schema de prețuri tipică:
| Furnizor | Model | Preț per 1M tokeni input | Preț per 1M tokeni output |
|---|---|---|---|
| OpenAI | GPT-5.6 | $15 | $60 |
| Anthropic | Claude Sonnet 5 | $3 | $15 |
| DeepSeek | V4 Flash | $0.28 | $0.28 |
Când rulezi Codex prin Bedrock, fiecare sesiune de coding poate consuma sute de mii sau milioane de tokeni — depinde de complexitatea task-ului. Un proiect mare poate genera ușor 5-10 milioane de tokeni pe zi.
Unde intervine bug-ul:
Problema e că, în cazul de față, sistemul de monitoring al costurilor nu a calculat corect consumul real. Utilizatorii au raportat că:
- Costurile afișate în dashboard-ul AWS nu corespunde cu cele reale de la facturare
- Nu există alerte automate când costurile depășesc un prag
- Calculul per token a fost greșit în anumite configurații de rulare
Cum te afectează dacă folosești Codex prin AWS Bedrock
Dacă ești un developer sau o companie care rulează Codex prin AWS Bedrock, iată ce riscuri concrete ai:
1. Facturi neașteptate de sute sau mii de dolari
Un utilizator a raportat o factură de $12.000 pentru o singură săptămână de rulare Codex, când se aștepta la circa $1.200. Diferența de 10x nu e o mică discrepanță — e un buget întreg de proiect anulat.
2. Fără alertă timpurie
AWS Cost Explorer și Buget Alerts nu au detectat problema la timp. Majoritatea utilizatorilor au descoperit diferența doar când a sosit factura sau când au verificat manual costurile în detaliu.
3. Dificultatea de a obține rambursare
După ce plătești, e mult mai greu să obții o rambursare de la AWS. Procesul de suport poate dura săptămâni, iar garantia de rambursare nu e automată.
Ce pași concreți poți face ACUM
Dacă folosești sau ai de gând să folosești Codex prin AWS Bedrock, iată ce trebuie să faci imediat:
1. Verifică costurile curente
Accesează AWS Cost Explorer → filtrează după serviciu “Amazon Bedrock” → verifică costurile pe ultimele 7 zile. Compară cu ceea ce te aștepți să fi consumat.
2. Setează alerte de buget
Mergi la AWS Budgets → Creează un buget nou → Setează o alertă la 50% și una la 80% din bugetul tău lunar. Alege să primești notificări pe email și SMS.
3. Limitează rate-ul de request-uri
În AWS Service Quotes, poți seta limite de request-uri per secundă (RPS) pentru modelele Bedrock. Asta previne scenariile în care un bug sau o buclă infinită generează consum masiv.
4. Folosește un API gateway cu rate limiting
Dacă ai aplicații interne care apelează Bedrock, pune în fața lor un API Gateway (AWS sau Kong, Traefik) cu rate limiting strict. Asta te protejează împotriva consumului necontrolat.
5. Monitorizează cu instrumente third-party
Instrumente cum ar fi Vantage.sh, CloudHealth sau InfraCost oferă monitoring mai detaliat decât AWS nativ, cu alerte pe anomalii de cost.
Alternative mai sigure pentru rularea Codex
Dacă bug-ul de mai sus te face să te gândești de două ori înainte să folosești Codex prin Bedrock, iată câteva alternative:
Direct prin OpenAI (fără AWS)
Codex e disponibil direct prin OpenAI — fie prin API-ul OpenAI, fie prin abonamentul Pro/Team. Avantajul e că ai prețuri transparente și suport direct de la OpenAI. Dezavantajul e că nu folosești infrastructura AWS pe care deja o ai.
Pe infrastructură proprie
Poți rula modele AI locale (Qwen 3.6, DeepSeek, Mistral) pe propriile servere sau prin un VPS. Asta îți dă control total asupra costurilor, dar necesită mai mult efort de setup și mentenanță.
Prin alte platforme cloud
Google Cloud Vertex AI și Azure AI Foundry oferă servicii similare cu Bedrock. Fiecare are propriile mecanisme de calcul al costurilor, dar principiul e același: verifică mereu și setează alerte.
Checklist de urgență
Dacă folosești Codex prin AWS Bedrock, parcurge această checklistă acum:
- Verifică costurile din ultimele 7 zile în AWS Cost Explorer
- Setează alerte de buget la 50% și 80%
- Limitează RPS-ul pentru modelele Bedrock folosite
- Configurează un API gateway cu rate limiting
- Activează notificări pe email/SMS pentru costuri
- Documentează-ți consumul mediu ca să poți detecta anomalii
- Fă un plan de urgență: ce faci dacă primești o factură de 10x
Întrebări frecvente
Codex prin AWS Bedrock e sigur pe termen lung?
Cum verific dacă am fost afectat de bug?
AWS rambursează costurile suplimentare cauzate de bug?
Alternativa cea mai sigură e să rulez Codex direct prin OpenAI?
Concluzie
Bug-ul de taxire de 10x la Codex pe AWS Bedrock e un reminder dur: când vine vorba de costuri AI, nu te baza pe nimeni altul să le monitorizeze pentru tine. Fie că folosești AWS, Google Cloud sau Azure, regula e aceeași — setează alerte, verifică regulat, și nu presupune că sistemul de facturare e infailibil.
Pentru români care lucrează în tech sau care au startup-uri, asta e și mai relevant. Un bug de $10.000 nu e doar o greșeală tehnică — e un risc financiar real care poate afecta o afacere mică. Investește 30 de minute acum în configurarea alertelor și te vei mulțumi mai târziu.
Atentie