本文回顾GPT系列发展:GPT-1确立Decoder-only预训练,GPT-2展现zero-shot潜力,GPT-3引入上下文学习,InstructGPT通过RLHF实现指令对齐,ChatGPT以对话形态普及,GPT-4迈向多模态。Decoder-only因训练简单、接口通用、扩展清晰而胜出,但存在推理延迟、长上下文成本、幻觉和对齐代价。
视频模型通过观察人类视频,不仅学习动作,还吸收了人类的“下意识选择”和偏见,形成一套“潜规则决策系统”。在电车难题测试中,模型倾向于逃避选择,如预测火车故障而非撞人,反映出“决策规避”和统计平均行为。这种偏见若用于行动模型,可能导致AI过度保守或行为偏差,需正视其放大效应,避免自动化灾难。
文章探讨了《红楼梦》续写的不同版本及其影响,强调个性与模仿的冲突。引用老子的治理智慧,认为最佳领导力在于让民众感受不到领导者的存在。最后,讨论修道的本质在于认识自心的清净与不生不灭,强调实践与现实的结合。
美团开源的LongCat-Video视频生成模型通过统一架构处理多种视频生成任务,具备长视频生成能力和高效推理,在文生视频和图生视频任务中表现优异,标志着世界模型构建的重要进展。
GPTLocalhost是一个本地Word插件,简化了在Microsoft Word中使用本地LLM服务器的过程。用户只需设置端口号、选择模型和工作区,即可处理文本并指定输出位置。它支持续写、重写和总结等多种任务,适合各类用户,提升Word的生产力。
完成下面两步后,将自动完成登录并继续当前操作。