#人工智能 深度求索测试 DS V4.1 Flash 模型的中间版本,原生多模态支持、能力更强、速度更快、成本也更低。

目前这个中间版本仅限内测用户调用,有内测用户分享的信息称,该模型速度非常夸张,最低也有 300tok/s,最高能到 600tok/s。

这应该是单独部署的版本所以速度才能如此快,正式上线应该不至于如此夸张。

查看全文:https://ourl.co/126773?t

补充:测试似乎可以直接使用新模型,不需要内测权限

😁订阅 🤔解封 🥰推特 🎉CN2VPS
来自频道: @landiansub
Loading comments...