➡️
继续阅读
-
吹爆开源!RunningHub让MiniMax H3满血提速12倍,本地部署照样起飞
RunningHub 为 MiniMax H3 开源模型推出 H3 Lightning 加速方案,结合后训练加速模型、SageAttention2、Cac...
-
这个新开源的世界模型只有1.3B,单卡就能实时跑!
蚂蚁灵波开源轻量版世界模型 LingBot-World 2.0,参数仅 1.3B,可在消费级单卡 GPU 上本地实时生成世界。团队先训练因果世界模型底座,...
-
FFmpeg Commander:在终端中检查、复制、粘贴
FFmpeg Commander 是一个免费网页工具,通过勾选选项自动生成 ffmpeg 命令,无需查阅文档。它覆盖格式、编解码器、码率、分辨率、截取和滤...
-
AWS 开源 Pizza Bot:为后台 AI 代理提供邮件式收件箱界面
AWS 发布开源项目 Pizza Bot,为后台运行的 AI 代理提供邮件式收件箱界面。代理自主运行,完成任务以未读线程呈现,需人工决策的事项则提示处理。...
-
物理AI掌舵:全球Robotaxi领军者如何借助英伟达技术构建未来
英伟达推出模块化Robotaxi三计算机方案,涵盖AI训练、仿真验证与车载计算。全球主要Robotaxi企业均采用该平台,包括Uber、特斯拉、奔驰、现代...
-
通过 CUDA 缓存技术实现 AI 模型部署加速
AI模型部署耗时主要来自加载权重、KV Cache初始化和CUDA内核编译。作者在T5000芯片上预编译CUDA内核,将cache、triton、nv等目...