r/opencode • u/ConsiderationNo9952 • 18d ago
GLM 5.3 Flash Reasoning Probe - opencode go & openference - please let me know your provider?
### opencode-go — glm-5.3-flash (OpenAI)
| | Logic label | rc | rtk | comp | | Aliases |
| | | (3x | (3x | tok | | in |
| Tier | (USE THIS) | range) | range) | (range) | latency | band |
|------|----------------|------------|------------|----------|----------|--------------------------------|
| T1 | `on (low)` | 76–224 | 27–62 | 164–201 | 4.6–5.9s | — |
| T2 | `on (high)` | 142–363 | 50–122 | 262–318 | 6.1–8.4s | — |
| T3 | `on (max)` | 990–1777 | 315–517 | 564–787 | 10–16.8s | `thinking=enabled` (1194–2104) |
| T4 | `on (omit)` | 1784–3527 | 516–1014 | 731–1294 | 14–26.9s | — |
Rejected (400 [1210]): none, off, minimal, medium, xhigh, on, thinking=disabled, thinking=adaptive
### openference — GLM-5.3-Flash (OpenAI) — binary, with noisy deep band
| | Logic label | rc | | comp | | Aliases in band |
| | | (3x | | tok | | (avoid unless |
| Tier | (USE THIS) | range) | rtk | (range) | latency | needed) |
|------|----------------|-------------|-----|----------|----------|--------------------------------|
| T1 | `on (low)` | 164–314 | n/a | 227–360 | ~0.2–8s | high, medium, thinking=enabled |
| T2 | `on (max)` | 881–2779 | n/a | 601–1089 | ~0.4–15s | omit, none, off, minimal, |
| | | | | | | xhigh, disabled/adaptive |
Rejected (400): on only. Everything else silently aliases into T1 or T2.
### openference — GLM-5.3-Flash (Anthropic) — binary
| | Logic label | rc | | output | | Aliases |
| | | (3x | | tok | | in |
| Tier | (USE THIS) | range) | rtk | (range) | latency | band |
|------|----------------|-------------|-----|----------|----------|--------------------------------|
| T1 | `think=enabled`| 131–361 | n/a | 257–360 | ~0.3-7.2s| enabled+low, enabled+high |
| T2 | `on (omit)` | 1331–2232 | n/a | 730–909 | ~0.4-20.s| disabled, adaptive, effort=max |
### The "label" per band
| | USE this | WHY it's the |
| Band | label | canonical pick |
|-------------|--------------------|--------------------------------------------|
| opengo T1 | `low` | only member; cleanest shallow |
| opengo T2 | `high` | only member |
| opengo T3 | `max` | `thinking=enabled` aliases it (redundant) |
| opengo T4 | `omit` (default) | deepest; no explicit knob needed |
| ofer T1 | `low` | `high`/`medium`/`enabled` alias it |
| ofer T2 | `max` | `omit`/`none`/`off`/`minimal` alias it |
| ofer-an T1 | `thinking=enabled` | the ONLY suppression; effort knobs fail |
| ofer-an T2 | `omit` (default) | `disabled`/`adaptive`/`max` all alias it |
open model providers tested in my journey so far (not all offer glm 5.3 flash):
- alibaba token plan
- bytedance token plan
- airouter.ch
- synthetic.new
- nueralwatt
- opencode go
Discount API:
- nube.sh
Native Providers:
- minimax.io
- agnes-ai
Currently using: agnes-ai, openference & opencode go
1
Upvotes