尽管当前DeepSeek提供的API服务定价已处于较低水平,但当使用频次与规模上升后,整体成本依然不容忽视。若希望实现Token使用的高度自主性,本地部署仍是更优路径。近期有消息显示,DeepSeek正积极推进一款面向本地运行的轻量级大模型研发工作。
据最新披露的内部投资人会议内容,DeepSeek创始人梁文锋确认,该轻量级模型已在内部进入测试阶段,具备在主流消费级显卡上稳定运行的能力。其功能覆盖范围较广,可有效支撑绝大多数日常应用场景。从相关表述判断,模型整体开发已趋近收尾,但具体上市时间及详细技术指标尚未对外公布。
在开源轻量级大模型领域,阿里推出的Qwen系列目前处于行业领先位置。其中,Qwen3.8 27B版本因其良好的本地适配性与综合性能表现,成为当前最受关注和广泛部署的选择之一。社区围绕该模型已衍生出大量优化版本,部分版本推理效率与稳定性已接近主流闭源模型的中高端水平,不仅足以应对常规事务处理,亦可胜任中等复杂度的代码编写任务。
DeepSeek此次轻量级模型的设计目标,明确指向主流桌面级显卡的兼容性。所谓“普通显卡”,虽未明确定义,但结合实际应用需求与硬件普及程度来看,RTX 4060或5060级别显卡应属合理预期范围——在此类硬件上实现每秒超30万亿次运算(30T/s)的持续推理吞吐,即可保障日常使用体验流畅稳定。对于多数用户而言,满足信息处理、内容生成、基础编程等常见需求已绰绰有余。

评论
更多评论