TokenHub
登录
textAVAILABLE

Qwen: Qwen3.5 Flash

bailian/qwen3.5-flash

Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

温度caps.top_pcaps.stop函数JSON推理

上下文

1M

最大输出

64K

输入

$0.100/M

输出

$0.400/M

PROVIDER · SELL PRICE

公开卖价

输入 /M

$0.100/M

输出 /M

$0.400/M

媒体 /秒

图像

不展示上游成本。客户账只看卖价。

ROUTING RECEIPT

可解释路径(示意)

bailian/qwen3.5-flash
→ published sell_price
→ attempt 1 provider whitelist
→ customer ledger one charge

真实 attempt 在登录后的用户台查看;此处不伪造 Playground 对话。

PLAYGROUND

试用 Qwen: Qwen3.5 Flash

对话不会被保存——离开或刷新页面后即清空。

登录后试用模态 · text

代码示例(固定)

curl http://localhost:8080/v1/chat/completions \
  -H "Authorization: Bearer sk-...xxxx" \
  -H "Content-Type: application/json" \
  -d '{"model":"bailian/qwen3.5-flash","messages":[{"role":"user","content":"hello"}]}'

常见问题

在 TokenHub 上使用 Qwen: Qwen3.5 Flash 需要多少钱?

公开卖价:输入 $0.100/M,输出 $0.400/M。以价目页实时数字为准。

Qwen: Qwen3.5 Flash 的上下文窗口是多少?

上下文 1M,最大输出 64K。

如何调用 Qwen: Qwen3.5 Flash?

注册拿 Key,把 base URL 换成品牌 API 域名,model 字段填 bailian/qwen3.5-flash。

支持哪些能力?

温度 · caps.top_p · caps.stop · 函数 · JSON · 推理

更多 bailian 模型

类似模型