New
Doubao flagship all-purpose general model, targeting complex reasoning and long-chain task execution scenarios in the Agent era. It emphasizes multimodal understanding, long-context reasoning, structured generation, and tool-augmented execution. It excels at handling complex instructions and multi-constraint execution, reliably addressing multi-step complex planning, intricate image-text reasoning, video content understanding, and high-difficulty analysis scenarios.
Pricing
Input Modalities
- Text
- Vision
- Video
Output Modalities
- Text
Capabilities
- Thinking
- Web
- Tools
- Tool calling
- Structured outputs
Try this model
Python
