#人工智能 深度求索测试 DS V4.1 Flash 模型的中间版本,原生多模态支持、能力更强、速度更快、成本也更低。目前这个中间版本仅限内测用户调用,有内测用户分享的信息称,该模型速度非常夸张,最低也有 300tok/s,最高能到 600tok/s。这应该是单独部署的版本所以速度才能如此快,正式上线应该不至于如此夸张。查看全文:https://ourl.co/126773
据深度求索内测群流传的消息,深度求索目前已经面向内测群用户推出 DS V4.1 Flash 模型的中间版本。所谓中间版本指的是还在训练中的新版本,这类版本并非最终版因此通常仅用于小范围测试而非直接发布。
根据深度求索内测群管理员的说法,DS V4.1 Flash 采用新的模型结构,原生多模态支持、能力更强、速度更快、成本也更低。对于有权限的用户可以直接调用该模型,调用地址不变,只需要将模型名称设置为 deepseek-v4.1-flash-expires-on-0910 即可调用。
当前适用于内测的版本价格与 V4 Flash 相同,每个账号限流 20 并发,这对大多数开发者来说应该是够用的,如果实在不够用那只能搭配正式版模型,正式版模型的并发更高。
更新:测试显示非内测用户也可以直接调用该模型,有兴趣的用户可以试试看。
据内测群用户分享的消息,DS V4.1 Flash 的响应速度非常夸张,最低也有 300tok/s,最高能达到 600tok/s。这个中间版本应该是部署在单独的服务器上供测试用户调用,所以响应速度着实让人惊讶,
这个速度在正式版中肯定实现不了,因此算是内测用户的福利,虽然同样要计费而不是免费的,但这么快的速度可以显著提升效率。






