➡️
继续阅读
-
Sarvam AI 发布 Saaras V4:面向全部 22 种印度语言和全球英语的语音转文字模型
Sarvam AI 发布语音识别模型 Saaras V4,覆盖 22 种印度法定语言及全球英语口音,宣称均达最先进准确率。模型采用编码器-解码器架构,解码...
-
写一个语音编程扩展插件
作者更新语音交互包,提升与 agent 对话的输入效率。支持三种模式:/voice 停顿自动转写、/voice ptt 按住空格说话、/voice aut...
-
edgeTTS 自托管语音合成 API
edgeTTS 是轻量级自托管语音合成服务,调用微软 Edge 在线朗读接口,提供 HTTP API 与 Web 工作台,支持流式传输、音色检索和 MP3...
-
Jobin Augustine: PgQ and PgQue: Workflow Engines you might need in PostgreSQL
In many real production databases, we often see some tables receiving high-fr...
-
keepane,AI 时代的终端多路复用
keepane 是用 Rust 写的,并非单纯的终端多路复用器:每个 pane(窗格)之间可以互相通信、投递消息,配过对的两台电脑之间也行,手机扫个码也能...
-
Mac技巧之把 Wi-Fi、电池、音量合成一个图标,节省菜单栏空间:Status Trio
Status Trio 是一款 Mac 菜单栏图标合并工具,灵感来自 iPhone Duo,可将 Wi-Fi、电池、音量三个常驻状态合并为一个图标,并按蓝...