内容提要
Witbe推出自研视觉语言模型Witbe VLMs,用于视频测试自动化,与通用模型协同工作。该模型针对机顶盒等特定场景训练,性能不逊于前沿模型,且延迟更低、成本更经济、支持数据主权。测试结果仍由确定性逻辑验证,基于真实设备KPI。CEO和COO强调模型专用性不影响通用性,客户已广泛部署。
延伸解读
专用模型与通用模型的协同
Witbe VLM并非替代通用模型,而是与其协同工作。通用模型在开放网络上训练,缺乏机顶盒、智能电视等特定场景的数据,而Witbe VLM则针对这些场景专门训练,弥补了通用模型的不足。这种分工使得测试自动化既能利用通用模型的广泛知识,又能获得专用模型对特定界面的深入理解,从而提升整体测试效率。
数据主权与合规优势
Witbe VLM支持将测试数据部署在客户自身基础设施内,确保数据不会离开客户环境。这对于面临数据驻留规则或内容保护义务的运营商尤为重要,使得AI在生产环境中得以应用。相比依赖云端通用模型,这种本地化部署提供了更强的数据控制力,降低了合规风险。
验证机制保持不变
尽管引入了新的AI模型,但Witbe的验证方式并未改变:模型负责解释,确定性逻辑负责验证。所有结果均基于真实设备上测量的KPI,并有视频记录作为证据。这种设计确保了测试结果的可靠性和可追溯性,避免了AI模型可能带来的不确定性,同时保留了AI比例的可调节性,从0%到100%灵活配置。
Q&A
Witbe VLMs是什么?
Witbe VLMs是Witbe公司自主研发和训练的视觉语言模型系列,用于在任何设备上实现视频测试自动化。
Witbe VLMs与通用模型有何不同?
Witbe VLMs专门针对机顶盒屏幕键盘、启动器网格等视频测试场景训练,而通用模型在开放网络上训练,缺乏这些特定知识。Witbe VLMs在特定场景下性能不逊于前沿模型,且延迟更低、成本更经济。
Witbe VLMs如何保证测试结果的准确性?
Witbe VLMs负责解释屏幕内容,但所有结果仍由确定性逻辑验证,基于真实设备上测量的KPI,并有视频记录作为证据。
Witbe VLMs在数据主权方面有哪些优势?
Witbe VLMs支持AI主权,测试数据(包括客户服务的录制视频)部署在客户自身的基础设施内,不会离开该环境,满足数据驻留规则和内容保护义务。
Witbe VLMs的通用性如何?
尽管Witbe VLMs是专门训练的,但在模型训练期间从未见过的应用场景中,其性能与前沿模型不相上下,因为跨应用场景共存的是屏幕和界面的行为模式。
Witbe VLMs相比之前有哪些改进?
Witbe VLMs相比之前延迟更低,测试套件完成更快,设备控制响应更灵敏;每次测试成本更低,行为更可预测,升级控制力更强;同时支持AI主权。
Witbe VLMs在实际部署中表现如何?
Witbe的客户已在数千台部署于现场的Witbox设备上运行智能体SDK,Witbe VLMs是下一步的模型演进,基于真实设备和环境的数据训练,提供更经济、更快速的方案。