在线体验
API 文档
https://docs.siliconflow.cn/cn/api-reference/chat-completions/
模型特点与性能
以视觉方式理解事物:不仅擅长识别花、鸟、鱼和昆虫等常见物体,还能分析图像中的文本、图表、图标、图形和布局。
可作为智能体:作为视觉智能体,可以推理并动态地使用工具,初步具备使用电脑和使用手机的能力。
在不同格式下进行视觉定位:通过生成生成边界框或点准确定位图像中的物体,为坐标和属性提供稳定 JSON 输出。
支持结构化输出:对于发票、表单、表格等数据,支持其内容的结构化输出,惠及金融、商业等领域的应用。
AI 社区评价
“Qwen2.5-VL 简直无敌,是最好的视觉语言模型。“
现在,免除部署难题,你可以直接在 SiliconCloud 上在线体验这款模型了。
Token 工厂 SiliconCloud
DeepSeek-R1 蒸馏版等免费用
作为一站式大模型云服务平台,SiliconCloud 致力于为开发者提供极速响应、价格亲民、品类齐全、稳定丝滑的大模型 API。
除了 Qwen2.5-VL-72B-Instruct、SiliconCloud 已上架包括 Wan2.1-T2V-14B、Wan2.1-T2V-14B-Turbo、QwQ-32B、DeepSeek-R1 & V3、DeepSeek-R1-Distill、Janus-Pro-7B、CosyVoice2、QVQ-72B-Preview、DeepSeek-VL2、HunyuanVideo、Qwen2.5-7B/14B/32B/72B、InternLM2.5-20B-Chat、BCE、BGE、SenseVoice-Small 在内的上百款语言模型、图片/视频模型、音频模型、代码/数学模型以及向量与重排序模型。
