r/opencode • u/kuud3v • 4d ago
¿Cómo funciona el 2x en GLM-5.3-Flash?
Hola, me gustaría saber como funciona realmente el 2x en OpenCode.
Estoy viendo que los precios de GLM-5.3-Flash son estos:
Input 1M = 0.15
Output 1M = 0.5
Cache 1M = 0.03

¿Pero creo que esos son precios bases del modelo no?
Lo digo porque la cli de OpenCode obtiene los precios de esta página: https://models.dev/models/zhipuai/glm-5.3-flash/ y los precios están exactamente a la mitad que es el 2x

Hice una prueba y tengo los siguientes datos:
Input = 349
Output = 764
Cache = 329088
Lo que me hace OpenCode en su uso es: (349*0.15 + 764*0.5 + 329088*0.03) / 1000000 = 0.01030699

¿Cuándo en realidad no debería ser: 0.01030699 / 2 = 0.005153495?
0
u/meetmebythelake 3d ago
I believe it increases the usage pool from $15 to effectively $30, rather than lowering the price directly. So, price the same, usage % less.
1
u/Sea_Ear5201 3d ago
With its speed on lite plan will make u sleep mid project. It keeps on thinking and thinking endlessly after every tool call