Files
2026-07-13 12:28:55 +08:00

29 lines
451 B
TOML

base_model = "tencent/hy3-preview"
[[reasoning_options]]
type = "effort"
values = ["none", "low", "high"]
[cost]
input = 0.19
output = 0.63
cache_read = 0.063
cache_write = 0.19
[[cost.tiers]]
tier = { type = "context", size = 16_000 }
input = 0.25
output = 1
cache_read = 0.094
cache_write = 0.25
[[cost.tiers]]
tier = { type = "context", size = 32_000 }
input = 0.32
output = 1.25
cache_read = 0.125
cache_write = 0.32
[limit]
output = 128_000