➡️
继续阅读
-
图像识别300毫秒!OpenCode视觉插件本地免费不用API
OpenCode Senses是一款本地运行的视觉插件,无需API密钥,通过Moondream2模型实现图像识别、OCR和对象检测等13种工具,所有分析在...
-
Universitas Gadjah Mada、Indosat与NVIDIA合作开设印尼首个大学AI中心,培养本地AI人才
印尼日惹的UGM Indosat NVIDIA AI技术中心正式启动,这是该国首个大学AI中心,由Komdigi、Indosat、NVIDIA和UGM合作...
-
给DeepSeek-V4-Flash借一双眼睛:ZCode视觉子Agent方案
ZCode用户使用纯文本模型deepseek-v4-flash无法识别图片。通过安装zcode-deepseek-eye技能,配置视觉子Agent(如mi...
-
不用出声也能聊天?苹果公开一项无声语音识别专利
苹果申请了一项默声语音检测专利,通过光学传感器捕捉面部肌肉微动,经神经网络解码为文字并合成语音,延迟低于100毫秒。系统支持耳机或眼镜集成,可离线或分布式...
-
金融医疗必看:敏感对话留在本地的开源语音AI完整方案
nanosamur.ai是开源语音AI平台,支持私有化部署,确保敏感语音数据安全,避免第三方风险。平台采用事件驱动架构和GPU加速,实现实时转录、精炼及声...
-
Liquid AI 发布 LFM2.5-VL-3B:一款 3B 视觉语言模型,可读取屏幕、识别物体并调用设备端工具
Liquid AI发布LFM2.5-VL-3B,31亿参数视觉语言模型,专为设备端设计,支持屏幕理解、函数调用、锚定和多图像输入。在28项基准测试中平均得...