[NS :
要求是大公司,比如硅基流动,使用qwen3vl8binstruct和qwen3embedding4b,是拿来做mtphoto的大模型智能识别本地部署过,但是速度有点慢,vl大概100token/s,embedding大概950token/s价格不能比硅基流动贵,硅基流动价格是vl输入0.5/m,输出2/membed
JH-hhh] 用千问冷门视觉模型,有没有推荐的中转站?要求是大公司,比如硅基流动,使用qwen3vl8binstruct和qwen3embedding4b,是拿来做mtphoto的大模型智能识别本地部署过,但是速度有点慢,vl大概100token/s,embedding大概950token/s价格不能比硅基流动贵,硅基流动价格是vl输入0.5/m,输出2/membed