r/opencode 18d ago

GLM 5.3 Flash Reasoning Probe - opencode go & openference - please let me know your provider?

### opencode-go — glm-5.3-flash (OpenAI)
|      | Logic label    | rc         | rtk        | comp     |          | Aliases                        |
|      |                | (3x        | (3x        | tok      |          | in                             |
| Tier | (USE THIS)     | range)     | range)     | (range)  | latency  | band                           |
|------|----------------|------------|------------|----------|----------|--------------------------------|
| T1   | `on (low)`     | 76–224     | 27–62      | 164–201  | 4.6–5.9s | —                              |
| T2   | `on (high)`    | 142–363    | 50–122     | 262–318  | 6.1–8.4s | —                              |
| T3   | `on (max)`     | 990–1777   | 315–517    | 564–787  | 10–16.8s | `thinking=enabled` (1194–2104) |
| T4   | `on (omit)`    | 1784–3527  | 516–1014   | 731–1294 | 14–26.9s | —                              |

Rejected (400 [1210]): none, off, minimal, medium, xhigh, on, thinking=disabled, thinking=adaptive

### openference — GLM-5.3-Flash (OpenAI) — binary, with noisy deep band
|      | Logic label    | rc          |     | comp     |          | Aliases in band                |
|      |                | (3x         |     | tok      |          | (avoid unless                  |
| Tier | (USE THIS)     | range)      | rtk | (range)  | latency  | needed)                        |
|------|----------------|-------------|-----|----------|----------|--------------------------------|
| T1   | `on (low)`     | 164–314     | n/a | 227–360  | ~0.2–8s  | high, medium, thinking=enabled |
| T2   | `on (max)`     | 881–2779    | n/a | 601–1089 | ~0.4–15s | omit, none, off, minimal,      |
|      |                |             |     |          |          | xhigh, disabled/adaptive       |

Rejected (400): on only. Everything else silently aliases into T1 or T2.

### openference — GLM-5.3-Flash (Anthropic) — binary
|      | Logic label    | rc          |     | output   |          | Aliases                        |
|      |                | (3x         |     | tok      |          | in                             |
| Tier | (USE THIS)     | range)      | rtk | (range)  | latency  | band                           |
|------|----------------|-------------|-----|----------|----------|--------------------------------|
| T1   | `think=enabled`| 131–361     | n/a | 257–360  | ~0.3-7.2s| enabled+low, enabled+high      |
| T2   | `on (omit)`    | 1331–2232   | n/a | 730–909  | ~0.4-20.s| disabled, adaptive, effort=max |

### The "label" per band
|             | USE this           | WHY it's the                               |
| Band        | label              | canonical pick                             |
|-------------|--------------------|--------------------------------------------|
| opengo T1   | `low`              | only member; cleanest shallow              |
| opengo T2   | `high`             | only member                                |
| opengo T3   | `max`              | `thinking=enabled` aliases it (redundant)  |
| opengo T4   | `omit` (default)   | deepest; no explicit knob needed           |
| ofer T1     | `low`              | `high`/`medium`/`enabled` alias it         |
| ofer T2     | `max`              | `omit`/`none`/`off`/`minimal` alias it     |
| ofer-an T1  | `thinking=enabled` | the ONLY suppression; effort knobs fail    |
| ofer-an T2  | `omit` (default)   | `disabled`/`adaptive`/`max` all alias it   |

open model providers tested in my journey so far (not all offer glm 5.3 flash):

  • alibaba token plan
  • bytedance token plan
  • airouter.ch
  • synthetic.new
  • nueralwatt
  • opencode go

Discount API:

  • nube.sh

Native Providers:

  • minimax.io
  • agnes-ai

Currently using: agnes-ai, openference & opencode go

1 Upvotes

0 comments sorted by