Qwen3 235B A22B FP8 Throughput
Hybrid instruct + reasoning model (232Bx22B MoE) optimized for high-throughput, cost-efficient inference and distillation.
This model is not available on Together’s Serverless API.
Related models
- TypeChatReasoning
- Main use casesChatReasoningMedium General PurposeFunction Calling
- FeaturesFunction Calling
- Parameters235.1B
- Context length40k
- Quantization levelFP8
- External link
- CategoryChat
