Article
Els models d'IA han abaixat el preu: què canvia això al teu pressupost (i què no)
Durant el juliol de 2026 el preu de fer servir els models d'intel·ligència artificial es va moure força, i cap avall. No és cap promoció d'estiu: és la continuació d'una tendència que fa anys que dura i que gairebé ningú no trasllada a l'empresari que fa uns mesos va rebre un pressupost i el va desar en un calaix.
Aquí tens què ha passat exactament, amb dates i xifres verificables, i una cosa que t'explicaran menys: quina part d'un projecte d'IA s'abarateix quan baixen els models i quina part no baixa ni un cèntim. Perquè no són el mateix, i confondre-les porta a pressupostar malament.
Què ha passat exactament el juliol de 2026
El moviment més comentat va venir d'OpenAI. El 9 de juliol de 2026 va llançar la família GPT-5.6 en tres variants —Sol per a la gamma alta, Terra per a la gamma mitjana i Luna per a l'ús econòmic— i tres setmanes després, el 30 de juliol, va anunciar una retallada de preus sobre dues d'elles.
Els preus es publiquen per milió de tokens i sempre en dues columnes: el que costa allò que li envies al model (entrada) i el que costa allò que et retorna (sortida). Així va quedar la cosa:
| Model d'OpenAI | En llançar-se (9 jul) | Després de la retallada (30 jul) |
|---|---|---|
| GPT-5.6 Sol | 5,00 $ / 30,00 $ | Sense canvis |
| GPT-5.6 Terra | 2,50 $ / 15,00 $ | 2,00 $ / 12,00 $ (un 20% menys) |
| GPT-5.6 Luna | 1,00 $ / 6,00 $ | 0,20 $ / 1,20 $ (un 80% menys) |
Els preus van en dòlars perquè és com els publiquen els proveïdors. No els convertim a euros aquí: el tipus de canvi es mou i una conversió d'avui seria un número fals d'aquí a un mes.
Anthropic: el mateix preu, més rendiment
El cas de Claude Opus 5, llançat el 24 de juliol de 2026, és diferent i convé entendre'l bé. El seu preu és de 5 $ / 25 $ per milió de tokens. El seu predecessor, Claude Opus 4.8, costava exactament el mateix: 5 $ / 25 $.
És a dir: allà no hi va haver baixada de preu, hi va haver més rendiment al mateix preu. A efectes del que t'importa, que és el cost d'una feina acabada, ve a ser el mateix: si el model encerta a la primera i necessita menys voltes per deixar-te el resultat bé, aquella feina t'ha sortit més barata encara que la tarifa no s'hagi mogut.
La tarifa per token és només la meitat de la història. L'altra meitat és quants tokens calen per acabar la feina.
La tendència de fons
Això no va començar al juliol. La firma d'inversió a16z, a la seva anàlisi Welcome to LLMflation, sosté que el cost per token a una qualitat equivalent va caient de l'ordre de deu vegades per any. És una estimació seva, no una dada oficial, però encaixa amb el que es veu a les tarifes publicades.
Què estàs pagant exactament quan pagues "per tokens"
Un token és el tros de text amb què treballa el model per dins. No és exactament una paraula: és una mica més petit. Una paraula corrent en català sol ocupar entre una i tres d'aquestes peces, i els signes de puntuació també compten. La idea que et serveix: es cobra per quantitat de text que passa pel model, no per pregunta ni per minut.
I es cobra en les dues direccions. El que entra —la pregunta, més tot el context que l'acompanya: l'historial de la conversa, el teu catàleg, els teus horaris, el document que li passes— té un preu. El que surt —la resposta— en té un altre, normalment unes quantes vegades més alt. Per això les tarifes es publiquen sempre com dues xifres separades per una barra.
La conseqüència pràctica és poc intuïtiva: una conversa llarga és cara sobretot per l'entrada, no per la resposta. Cada vegada que el client escriu un missatge nou, el sistema torna a enviar tota la conversa anterior perquè el model sàpiga de què s'està parlant. Un agent ben muntat controla això; un de muntat a la brava, no.
Què baixa, què no baixa, i per què importa la diferència
Aquí hi ha la part que gairebé no s'explica, i és la que decideix si el teu pressupost canvia o es queda igual. En un projecte d'IA per a una pime, el preu del model gairebé mai no és el que el fa car.
Pensa en un agent que atén el telèfon d'un taller. El que costa allà és entendre com treballa aquell taller, connectar l'agent amb l'agenda que ja fan servir, decidir què pot prometre i què no, provar-ho amb trucades reals i mantenir-lo viu quan canviïn els horaris o els preus. Els tokens d'aquelles trucades són la línia petita del compte.
Baixa: el consum del model
La part variable, la que creix quan creix l'ús. És la que s'ha mogut aquest juliol i la que continuarà movent-se. Com més volum tinguis, més t'afecta la baixada.
No baixa: entendre el teu negoci
Seure a veure com funciona el teu procés, quins casos rars hi ha i quines decisions no pot prendre una màquina. Són hores d'una persona i valen el que valen.
No baixa: la integració
Connectar amb la teva agenda, el teu ERP, el teu programa de gestió o la teva centraleta. Depèn del que tinguis muntat, no del que costi un model.
No baixa: el manteniment
Un agent que atén clients no es deixa sol. Canvien els preus, els horaris, la carta, el catàleg. Algú ho ha de revisar i corregir el que surti malament.
No baixa: la formació
Que el teu equip sàpiga fer servir el que li has posat al davant. És cost de persones i, a més, és una obligació del reglament europeu d'IA des del febrer de 2025.
Que els models siguin deu vegades més barats no fa que el teu projecte sigui deu vegades més barat. Fa que la seva part variable pesi menys.
Això té una lectura optimista i una d'incòmoda. L'optimista: si el que et frenava era el cost recurrent —"i això quant em costarà cada mes?"— aquesta por té bastant menys fonament l'agost de 2026 que fa un any. La incòmoda: si el que et frenava era la posada en marxa, aquella xifra no s'ha mogut i no es mourà, perquè són hores de persones.
Quina de les dues pesa més al teu cas depèn del volum. Un negoci que rep quatre trucades al dia té un consum testimonial i tot el cost a la posada en marxa; un que atén centenars de converses a la setmana nota la baixada de debò. Separar aquestes dues partides és el primer que fem en una consultoria d'IA, abans de recomanar res.
La lletra petita que convé mirar abans de celebrar res
Circula aquests dies una generalització fàcil —"tot baixa, cada vegada és més barat"— i no és del tot certa. El contraexemple és publicat a la documentació mateixa de Google.
Gemini 3.7 Flash, llançat el 13 d'agost de 2026, i Gemini 3.6 Flash són a 0,75 $ / 3,75 $ per milió de tokens. Però és un preu introductori: la pàgina oficial de preus de Google indica que es duplica l'1 de gener de 2027, fins a 1,50 $ / 7,50 $. Per comparar, Gemini 3.5 Flash és a 1,50 $ / 9,00 $ i Gemini 3.5 Flash-Lite a 0,30 $ / 2,50 $.
No és cap trampa: està publicat i a la vista de qualsevol. És simplement el tipus de detall que se li escapa a qui munta un projecte sobre un model concret i no torna a mirar la tarifa. Aquestes són les preguntes que convé fer a qui et munti alguna cosa:
"Quin model fa servir això i què passa si puja de preu?"
La resposta bona és que el model es pot canviar sense refer el projecte. Si et diuen que caldria començar de zero, hi estàs lligat.
"La tarifa que sosté aquest compte és introductòria?"
Pregunta-ho explícitament. És informació pública, és a la pàgina del proveïdor, i qui t'ho munta ho hauria de saber.
"El consum va al meu nom o al vostre?"
Canvia molt la conversa. Si el compte del proveïdor és teu, la baixada et beneficia directament. Si va inclòs en una quota tancada, la baixada se la queda qui te la cobra.
"Què m'enduc si un dia me'n vaig?"
No té a veure amb el preu, però és el moment de preguntar-ho. Un projecte del qual no et pots endur ni la configuració ni les dades és car encara que surti barat.
Si vas descartar un projecte pel cost, el compte ja no és el mateix
Aquesta és la conclusió accionable, i va dirigida a un cas molt concret: vas demanar pressupost el 2025, vas fer números, no sortia i ho vas deixar estar. És probable que aquell compte estigui desactualitzat pel costat del cost recurrent.
Refer-lo no requereix que truquis a ningú. Són tres passos:
Per a la part de l'estalvi tens la calculadora de la guia d'IA per a pimes: hi poses les hores setmanals que es menja una tasca repetitiva i el seu cost per hora, i et diu què costa a l'any. No envia res enlloc, el càlcul es fa al teu navegador.
I si el que et frena és la inversió inicial i no el cost per ús, aquesta part té una altra via: els ajuts públics per implantar IA en una pime cobreixen precisament el pagament únic, que és justament el que no baixa sol.
Preguntes freqüents
Si baixa cada any, no em convé esperar que baixi més?
Si el projecte ja et surt a compte avui, esperar és renunciar a l'estalvi dels mesos que esperis. A més, el que baixa és la part variable, que sol ser la menor; la part que no baixa et costarà igual d'aquí a un any. Esperar té sentit quan el cas és just al límit, no quan ja és clar.
Això vol dir que el meu projecte serà un 80% més barat?
No. Aquella retallada és sobre la tarifa d'un model concret, no sobre un projecte. En una pime, el consum del model sol pesar poc dins del total comparat amb la posada en marxa, la integració i el manteniment, que no s'han abaratit.
Per què doneu els preus en dòlars i no en euros?
Perquè és com els publiquen els proveïdors. Convertir-los aquí seria donar-te una xifra que deixa de ser certa tan bon punt es mogui el tipus de canvi, i preferim no publicar números que caduquen sols.
Em quedo lligat al proveïdor del model que triï ara?
No hi hauries d'estar. Un projecte ben plantejat deixa el model com una peça intercanviable, de manera que canviar-lo sigui una decisió de configuració i no refer la feina. Si t'ofereixen una cosa on això no és possible, pregunta per què abans de signar.
Vosaltres amb quin model treballeu?
Depèn del que s'hagi de fer, i no és una evasiva comercial: per classificar correu i per parlar amb un client no convé el mateix. Aquesta tria es pren quan se sap què cal resoldre i s'explica amb els seus motius, no com una marca tancada per endavant.
Aquests preus continuaran vigents quan llegeixi això?
Probablement no tots. Per això estan datats i per això tens els enllaços oficials al final. A dalt hi surt la data de darrera revisió de l'article: si hi has arribat mesos després, comprova els números a l'origen abans de fer-los servir.
Fonts consultades
- OpenAI — Advancing the price-performance frontier with GPT-5.6 · font oficial
- CNBC — OpenAI retalla el preu dels seus models (30-07-2026) · consultat 26-08-2026
- Axios — OpenAI cuts prices for GPT-5.6 Terra and Luna (30-07-2026) · consultat 26-08-2026
- Anthropic — Preus dels models Claude · font oficial
- Google — Preus de l'API de Gemini · font oficial
- a16z — Welcome to LLMflation · consultat 26-08-2026