小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

LiteRT-LM brings native support for Gemma 4 Multi-Token Prediction (MTP) drafters, enabling up to 2.2x faster inference. The framework is expanding beyond Kotlin and C++ adding support for new...

Google LiteRT-LM Speeds up Local Inference up to 2.2x with Gemma 4 Multi-Token Prediction

InfoQ InfoQ · 2026-06-05T09:00:00Z
谷歌的新LiteRT加速器为高通Snapdragon驱动的Android设备提供强劲的AI工作负载支持

谷歌推出LiteRT的新加速器QNN,显著提升高通Snapdragon 8 SoC设备的AI性能。QNN在CPU上速度提升可达100倍,GPU提升10倍,支持90种LiteRT操作,优化LLM性能。在72个ML模型中,有64个成功实现NPU全委托,极大改善用户体验。

谷歌的新LiteRT加速器为高通Snapdragon驱动的Android设备提供强劲的AI工作负载支持

InfoQ InfoQ · 2025-11-30T20:00:00Z
LiteRT - 一种高性能、可扩展的轻量级深度学习推理运行时用于…

LiteRT是谷歌基于TensorFlow Lite开发的轻量级推理运行时,适用于资源受限的边缘设备。V1兼容经典TFLite API,V2引入异步执行和自动加速器选择,支持多平台。其主要特点包括跨平台支持、硬件加速、异步高效I/O和生态系统兼容性,适合移动实时推理、嵌入式设备和生成模型加速。

LiteRT - 一种高性能、可扩展的轻量级深度学习推理运行时用于…

云原生 云原生 · 2025-11-26T04:02:48Z
谷歌增强LiteRT以实现更快的设备端推理

LiteRT新版本简化了机器学习推理,增强了GPU和NPU加速支持。新API使开发者更易利用加速,模型速度提升25倍,功耗降低5倍,同时优化了推理性能,支持异步执行以减少延迟。

谷歌增强LiteRT以实现更快的设备端推理

InfoQ InfoQ · 2025-05-24T08:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码