doubao-embedding-vision · Doubao · embedding
ByteDance Doubao Embedding Vision, multimodal embedding model supporting both image and text input.
Multimodal embedding (image + text); semantic search; RAG retrieval; clustering; classification.
Multimodal RAG; visual search; document clustering; image-text similarity matching.
No text generation; no Function Calling; output dimension fixed; image input costs more.
Anthropic official CLI coding agent. Multi-file edits, tool use, long-context reasoning.
export ANTHROPIC_AUTH_TOKEN="YOUR_API_KEY"
export ANTHROPIC_BASE_URL="https://api.robovai.com"
export ANTHROPIC_MODEL="doubao-embedding-vision"
claude