GLM-5.3在AI评委的创意写作测试中获全球第二,但人类投票榜未进前十,引发争议。测试由7个LLM评委按16维度打分,GLM-5.3因学会制造冲突而提升,但文笔被指退步。文章质疑AI评AI的可靠性,并指出其编程和安全能力提升显著,但“好故事”标准因AI介入而模糊。
阿里Qwen 3.6 27B本地模型在笔记本上运行表现出色,生成代码和创意写作效果接近顶级API。尽管运行时电脑发热严重,但其性能和数据安全性使得本地部署成为理想选择。用户认为该模型适合简单开发任务,但在复杂项目中表现有限。整体来看,Qwen 3.6 27B是本地开发的强大工具。
谷歌在美国推出了AI模式下的Canvas功能,支持创意写作和编码任务,用户可以实时生成文档和信息面板。目前该功能仅支持英语。
Canvas在美国推出AI模式,支持创意写作和编程任务。用户可创建自定义工具和仪表板,轻松组织项目。通过工具菜单选择Canvas选项,描述想法即可生成原型,便于测试和调整。
本文讨论了GPT-5在创意写作和医学研究中的应用,发布于2025年8月7日。
百度文心大模型5.0正式上线,参数达到2.4万亿,具备全模态理解与生成能力,支持文本、图像、音频和视频等多种信息。该技术采用统一自回归架构,提升推理效率,显著增强多模理解、代码生成和创意写作能力。百度千帆平台已支持企业用户便捷调用文心5.0,助力各行业应用。
LMArena最新排名显示,文心大模型5.0 Preview以1451分位居国内第一,超越多款主流模型,尤其在创意写作和复杂任务中表现突出,预计正式版将于1月上线。
本文强调提示工程的重要性,提供七种实用提示模板,涵盖求职信、数学推理、代码生成、学习辅导、创意写作、头脑风暴和商业策略等领域。合理的提示能提高大型语言模型的响应准确性和有效性。
OpenAI于8月7日发布了最新的人工智能模型GPT-5,具备更强的编码、创意写作和复杂推理能力。该模型将分批向所有ChatGPT用户开放,Plus和Pro会员可享受更多功能。CEO萨姆·奥尔特曼称其为“巨大飞跃”,并表示GPT-5是实现通用人工智能的重要一步,特别在编程、创意写作和健康领域表现突出。
OpenAI于8月8日发布了新一代AI模型GPT-5,具备更强的编程、创意写作和健康问诊能力,优化了回答的统一系统和推理模型,表现优于前代,开启了AI与人类社会的新协作模式。
GPT-5发布,显著提升编程、创意写作和健康咨询能力,优化推理和回答准确性,尤其在复杂任务中表现优异。其在代码生成和健康问题识别方面取得新高,展现强大技术实力。
AlphaWrite是一个新框架,通过结构化和可测量的改进来提升创意写作。它利用进化算法迭代生成多样化故事,并通过评估系统筛选优秀作品进行优化。尽管结果积极,但对AI在创作领域的作用存在不同看法。该系统同样适用于技术写作和学术内容。
大型语言模型(LLMs)在创意写作和语言任务上表现优异,但在基础知识检索和数学计算方面常出现错误。使用工具可以提升模型表现。测试表明,尽管一些小模型在使用工具时能正确计算,但它们通常不愿意使用工具,可能需要更多训练以认识自身局限。
字节跳动发布的Seed-Thinking-v1.5模型在数学、编程和科学任务中表现优异,参数量达到2000亿。其混合专家架构和强化学习方法提升了推理能力,尤其在创意写作方面表现突出。尽管在某些领域仍有不足,但其系统性方法为AI推理能力提升提供了新思路。
DeepSeek V3 更新至「DeepSeek-V3-0324」,可在 Hugging Face 下载。新版本参数为6850亿,支持MIT开源协议,代码能力强,优于Claude 3.5/3.7,适合创意写作和前端开发。用户测试显示其生成的HTML5和CSS代码优秀,性能接近OpenAI o1-pro,价格更具优势。
OpenAI推出了一套新的智能体开发框架,包含网页搜索和文件搜索等多种工具,结合了原有的Chat Completions API,旨在提升智能体功能。新模型在创意写作和情感理解方面表现优异。新工具的定价较高,开发者按使用次数收费。文章通过虚构角色米拉和凯的故事探讨了AI与悲伤的主题。
Sam Altman 宣布更新了 GPT-4o,强调其搜索能力和个性化对话。用户发现其更亲和,能编写故事,但仍拒绝成人内容。GPT-4o 在创意写作和情感描写上表现出色。OpenAI 计划减少对成人内容的限制,未来可能会更开放,但需平衡用户自由与安全。
新版GPT-4o超越DeepSeek-R1,在创意写作和编程等领域表现优异,回复更具个性和拟人化,用户反馈显示其理解用户心理的能力提升。尽管与自定义GPTs不兼容,但整体表现令人惊喜。
布兰登·桑德森是《风暴之光》和《迷雾之子》等畅销书的作者,销量超过4000万本。他教授创意写作,并参与播客《Intentionally Blank》,还成功完成《时光之轮》系列,曾获雨果奖。
DeepSeek-R1模型经过测试,表现与OpenAI高级模型相当,性价比高。测试涵盖创意写作和数学等领域,DeepSeek在多个项目中表现优异,但在一些基础问题上出现错误。整体来看,DeepSeek-R1具备与OpenAI竞争的实力。
完成下面两步后,将自动完成登录并继续当前操作。