Il problema della lettura della cache: perché GLM 5.3 costa di più nel lavoro con agenti reali
Le velocità di input e output di GLM 5.3 sembrano modeste, ma nelle lunghe sessioni dell'agente fino al 90% del conto è rappresentato dalle letture della cache. Abbiamo misurato cosa significa rispetto a DeepSeek.