就内容创作而言,说话还是替代不了打字

就内容创作而言,说话还是替代不了打字

💡 原文中文,约2600字,阅读约需7分钟。
📝

内容提要

语音输入工具如Typeless宣称语音是原生输入方式,但作者认为其实际体验不佳,尤其在公共场合使用会打扰他人,且剥夺思考过程。创作需反复推敲,打字是思考的一部分,语音输入无法替代。作者引用《美国讲稿》强调写作可修改的重要性,认为语音输入营销忽略了创作内核。

🔎

延伸解读

语音输入的实际体验与宣传的差距

文章指出,Typeless 等新型语音输入工具虽然通过大语言模型优化了转写结果,但实际使用中仍存在明显问题。作者在公共场合使用时会感到打扰他人,且低语模式未经验证。更关键的是,在即时通讯中尝试用语音输入时,作者多次说出口水词,工具无法有效润色,最终只能放弃。这表明语音输入在真实场景中的表现远不如宣传中那么理想。

创作中的思考过程难以被语音替代

作者强调,内容创作并非追求速度,而是需要反复推敲和修改。打字过程本身就是思考的一部分,通过选中、删除、重写来调整表达。而语音输入是线性的,难以回溯修改,即使有指令修正,也打断了思考的连贯性。因此,语音输入在创作领域并不适用,其“说话比打字快”的营销忽略了创作的本质。

语音输入工具的适用场景有限

文章提到,语音输入工具在特定场景下确实有优势,例如律师需要快速回复客户时,Typeless 能高效生成专业回复。但作者认为,这种工具更适合快速回复类任务,而非深度创作。对于需要精心打磨的内容,语音输入无法替代键盘输入。因此,用户应根据自身需求选择输入方式,而非盲目相信营销宣传。

Q&A

Typeless 这类新型语音输入工具与传统语音输入有什么不同?

传统语音输入算法会忠实转写所有语音,包括停顿和口水词;而 Typeless 和 Wispr Flow 这类工具会将转写结果交给大语言模型处理,移除口水词,理解替换词指令,并打磨输出,使结果更干净。

作者认为语音输入在公共场合使用有什么问题?

作者认为在公共场合使用语音输入会打扰他人,让人感觉“不会读空气”,即使有低语模式,但作者未实际体验,因此认为这是一个缺陷。

作者为什么认为语音输入会剥夺思考过程?

作者认为创作需要反复推敲,打字是思考的一部分,而语音输入是线性且无法回溯修改的表达过程,会强迫用户将思考过程外包,从而剥夺思考。

作者在什么场景下尝试使用 Typeless 并遇到了困难?

作者在即时通讯应用上想分享一段话并加附注时,因输入法 bug 导致乱码,被迫使用 Typeless,结果多次说出口水词且错误频出,最终无法润色出合理句子,只能从其他应用输入后粘贴。

作者引用《美国讲稿》的片段想说明什么?

作者引用《美国讲稿》中关于写作可多次修改的论述,强调写作需要反复修改,而语音输入无法提供这种修改过程,从而支持其观点:语音输入不适合创作。

作者对 Typeless 和 Wispr Flow 的营销有何评价?

作者认为它们的营销(如“语音是原生输入方式”和打字比赛)忽略了创作的实际内核,因为创作不是速度为先的行为,语音输入无法替代打字在思考中的作用。

🏷️

标签

➡️

继续阅读