➡️
继续阅读
-
论文周报丨Vidu S2实现实时720P数字人生成与视频编辑;NCP-ArchPreview探索LLM隐空间预训练新范式...速览一周AI前沿论文
清华大学与生数科技推出 Vidu S2,包含 Avatar 和 Editing 两个模型,支持实时 720p 数字人生成、动态参考图更新、视频流风格迁移、...
-
jev-experiments:Jev在各类低延迟交互场景中的应用范例集合
dabit3/jev-experiments 汇集20多个实验,探索 TypeSafe Jev 低延迟决策模型(70-500毫秒,远快于LLM)的应用,覆...
-
Live Captioning Engineering:业界首个直播电商 AI 实时字幕系统的端到端实践
快手电商直播团队构建了业界首个大规模实时字幕系统,通过统一媒体PTS时间线、源站单份生产、两级级联分发和客户端版本化渲染,将端到端延迟从2秒降至500毫秒...
-
刷屏的 Jev 是啥?12 个真实场景看懂“系统一”AI
TypeSafe AI推出Jev模型,不生成文字,只输出选择、评分和判断,类似人的直觉“系统一”。它把日常简单决策从昂贵的大模型调用中剥离,以极低成本毫秒...
-
非自回归决策模型对比:Jev和Laya在工单分类场景下谁更快
Jev与Laya代表两类决策模型:Jev为闭源API,支持类型化输出与64K上下文,端到端延迟236毫秒起,无需微调;Laya为开源底座,单卡前向仅32....
-
《No Dogs in Space》回归,满足你对音乐史痴迷的需求
In August, I wrote about my love of the music history podcast No Dogs in Spac...