qwen3-vl-plus · Qwen · vision
Alibaba Cloud's Tongyi Qianwen vision model Qwen3 VL Plus offers a 128K context window with support for image, video, and PDF understanding. It is ideal for multimodal Q&A, document parsing, and image content extraction, and supports Function Calling and JSON mode.
128K context; vision understanding (image/video/PDF); Function Calling; JSON mode; OpenAI-compatible interface.
Multimodal Q&A; document parsing (PDF/Word); image content extraction; video content understanding; form extraction; image recognition.
Does not generate images; no explicit caching support; 128K context; high concurrency requires an Alibaba Cloud quota.
Anthropic official CLI coding agent. Multi-file edits, tool use, long-context reasoning.
export ANTHROPIC_AUTH_TOKEN="YOUR_API_KEY"
export ANTHROPIC_BASE_URL="https://api.robovai.com"
export ANTHROPIC_MODEL="qwen3-vl-plus"
claude