深度求索测试DS V4.1 Flash模型的中间版本 原生多模态支持/速度更快/成本更低
2026-9-8 10:56:39 Author: www.landian.news(查看原文) 阅读量:7 收藏

#人工智能 深度求索测试 DS V4.1 Flash 模型的中间版本,原生多模态支持、能力更强、速度更快、成本也更低。目前这个中间版本仅限内测用户调用,有内测用户分享的信息称,该模型速度非常夸张,最低也有 300tok/s,最高能到 600tok/s。这应该是单独部署的版本所以速度才能如此快,正式上线应该不至于如此夸张。查看全文:https://ourl.co/126773

据深度求索内测群流传的消息,深度求索目前已经面向内测群用户推出 DS V4.1 Flash 模型的中间版本。所谓中间版本指的是还在训练中的新版本,这类版本并非最终版因此通常仅用于小范围测试而非直接发布。

深度求索测试DS V4.1 Flash模型的中间版本 原生多模态支持/速度更快/成本更低

根据深度求索内测群管理员的说法,DS V4.1 Flash 采用新的模型结构,原生多模态支持、能力更强、速度更快、成本也更低。对于有权限的用户可以直接调用该模型,调用地址不变,只需要将模型名称设置为 deepseek-v4.1-flash-expires-on-0910 即可调用。

当前适用于内测的版本价格与 V4 Flash 相同,每个账号限流 20 并发,这对大多数开发者来说应该是够用的,如果实在不够用那只能搭配正式版模型,正式版模型的并发更高。

更新:测试显示非内测用户也可以直接调用该模型,有兴趣的用户可以试试看。

据内测群用户分享的消息,DS V4.1 Flash 的响应速度非常夸张,最低也有 300tok/s,最高能达到 600tok/s。这个中间版本应该是部署在单独的服务器上供测试用户调用,所以响应速度着实让人惊讶,

这个速度在正式版中肯定实现不了,因此算是内测用户的福利,虽然同样要计费而不是免费的,但这么快的速度可以显著提升效率。

热门推荐仅需99元/年,硅谷CN2GIA服务器,另有3年版仅需528元,限量销售,售完即止

  • ICANN批准威瑞信终止.NAME三级域名服务 约有2.2万个域名将被删除

  • 谷歌收紧安卓17开发者模式信息访问 读取USB调试和开发者选项始终返回0

  • 微软正在开发Windows 11电池与外设小部件 可以放到锁屏界面显示电量和连接状态

  • Windows 10/11桌面变成哈利波特电影宣发广告?这是微软通过必应壁纸投放的

  • 有开发者分析发现:Codex使用重置卡获得的额度只有正常量的50%

  • 谷歌不仅延长服务器硬件使用寿命 现在还开始拆内存重新利用起来


文章来源: https://www.landian.news/archives/126773.html
如有侵权请联系:admin#unsafe.sh