原文中文,约14200字,阅读约需34分钟。
📝
内容提要
李沐在上海交大分享了关于语言模型和个人生涯的演讲,讲述了语言模型的算力、数据和算法三个方面,以及硬件、数据和算法未来的发展。他还提到了预训练和后训练的区别,以及垂直模型和评估的重要性。分享了自己的打工人、读博士和创业的经历,以及持续提升自己的方法。鼓励大家抓住当前技术带来的机会,付出更多努力。
❓
Q&A
李沐在演讲中提到的语言模型的核心要素是什么?
语言模型的核心要素包括算力、数据和算法。
李沐如何看待未来算力和内存的发展?
未来几年,算力、内存和带宽将会有显著的发展,算力价格长期来看会逐渐降低。
李沐在演讲中分享了哪些个人经历?
李沐分享了自己在大公司、读博士和创业的经历,强调了不同阶段的目标和挑战。
李沐对创业的看法是什么?
李沐认为创业需要强烈的动机和对复杂社会的理解,同时也面临许多挑战。
李沐提到的持续提升自我的方法是什么?
李沐建议定期总结和反思个人目标,以持续提升自我。
李沐如何看待当前技术带来的机会?
李沐鼓励大家抓住当前技术带来的机会,付出更多努力以获得成功。
🏷️