Qwen3.8 Flash
inferway/qwen3.8-flashQwen's efficiency-focused Flash model.
- Model input
- TextImage
- Model output
- Text
General-purpose chat and tool use, served at FP8 on hardware we operate. OpenAI-compatible — point base_url at us and keep your SDK.
Loading prices
Video generation, served at INT8 on hardware we operate. Submit one request and poll until the clip is ready — same API key as every other model.
Loading prices
inferway/qwen3.8-flashQwen's efficiency-focused Flash model.
inferway/deepseek-v4.1-flashDeepSeek's efficiency-focused V4.1 Flash release.
inferway/glm-5.3-flashZ.ai's Flash model for coding and agentic workloads.