2026年9月23日,开发者Cactus Compute正式推出新一代轻量级AI模型Needle 2。该模型体积仅14MB,专为树莓派5处理器架构深度定制,在不依赖任何AI加速扩展硬件的前提下,可将自然语言指令实时解析并映射至预设函数调用。
Needle 2并非面向通用对话的聊天模型,而是一款聚焦于设备端指令执行的专用推理引擎。例如,当用户输入“点亮LED灯”时,系统从语义识别、意图解析到硬件动作执行的全流程耗时仅为78毫秒,实现近乎无感的响应体验。
在资源效率方面,Needle 2展现出突出的轻量化能力。实测显示,在搭载8GB内存的树莓派5上运行该模型,其自身内存占用稳定维持在约28MB;若连同配套的Python演示程序一并加载,整体内存消耗亦仅46.4MB。这一设计使其完全摆脱对云端服务与网络连接的依赖,真正实现边缘侧全本地化智能控制。
在硬件集成层面,Needle 2采用Python原生标注机制,与底层系统紧密协同。开发者仅需在已有函数定义中添加标准注释,模型即可自动提取函数名、功能说明及参数类型等元信息,并据此构建精确的调用协议。以“查询处理器温度”为例,指令响应时间为149毫秒,结果以摄氏度数值形式直接返回,全程在设备本地完成计算,无需外部介入。
值得注意的是,该模型在逻辑边界处理上保持高度克制:对于超出预设函数范围的提问——如询问“法国首都是哪里”——模型将在92毫秒内返回空值,杜绝模糊匹配或臆测输出,确保行为可预期、执行可追溯。
目前,Needle 2的模型权重已公开发布,相关源代码亦依据Apache 2.0许可证开放共享。

评论
更多评论