内容提要
Codette是一种多视角认知架构,通过六个不同性格的AI专家协作解决复杂问题,性能比单一AI提升近一倍。它利用“茧”记忆系统,在积累951个记忆单元后实现质变,并内置AEGIS道德陪审团增强伦理判断。该架构将思考与表达分离,仅用80亿参数模型和普通显卡,就在GPQA测试中显著提升准确率,展示了高效智能进化的新路径。
延伸解读
记忆的“规模阈值”效应
Codette的实验显示,记忆增强并非线性有效。当记忆单元仅有217个时,提升几乎可以忽略;而达到951个后,效果才显著。这提示AI记忆系统可能存在一个“临界点”,在此之前,记忆可能引入噪音,甚至干扰性能。对于工程实践而言,这意味着构建记忆增强型AI时,需要积累足够多的记忆样本,才能发挥其潜力,否则可能事倍功半。
道德框架的“主观性”风险
Codette内置的AEGIS道德陪审团,通过六种道德框架(如功利主义、义务论等)来约束AI行为,显著提升了抗诱导能力。然而,作者也坦言,这些框架的默认权重仅基于开发者个人的“三观”。这引发了一个关键问题:将个人道德偏见封装进看似客观的算法中,是否可能成为另一种形式的“极权”?在部署此类系统时,需警惕道德标准的主观性和潜在偏见。
“思考与表达分离”的启示
Codette将“认知底稿”与“语言渲染”分离,先用轻量级模板生成结构化草稿,再让大模型扩写,从而大幅减少幻觉。这种设计将大模型从“创作者”降为“朗读者”,限制了其自由发挥空间。这一思路对降低AI幻觉具有实用价值,尤其适用于对准确性要求高的场景,如专业问答或内容生成,可有效提升输出的可靠性和一致性。
Q&A
Codette是什么?它如何提升AI性能?
Codette是一种多视角认知架构,通过六个不同性格的AI专家协作解决复杂问题,性能比单一AI提升近一倍。
Codette的“茧”记忆系统有什么特点?
Codette的“茧”记忆系统将每次有价值的对话封存为记忆单元。实验发现,当记忆单元数量达到951个时,记忆增强效果发生质变,显著提升性能;而记忆量不足时效果甚微。
AEGIS道德陪审团是如何工作的?
AEGIS道德陪审团内置六种道德框架(功利主义、义务论、德行伦理、关怀伦理、乌班图哲学、代际可持续性),同时审视AI的每一步思考,若发现违背伦理则修正输出,从而增强抗诱导能力。
Codette如何实现思考与表达的分离?
Codette将推理过程分为“认知底稿”和“渲染表达”两层。上层用轻量级模板和检索生成结构化草稿,下层语言模型仅负责扩写,不添加新知识,从而减少幻觉,提升自然度。
Codette在GPQA测试中的表现如何?
Codette仅用80亿参数模型,在GPQA钻石级测试中准确率从25.3%提升到30.8%,比单纯思维链提示高5个百分点,展示了高效智能进化的新路径。
Codette的“策略演化”模块效果如何?
Codette的策略演化模块试图从记忆单元中提取跨领域思维模式,但总体提升仅0.8%,在统计学上不显著,说明其内省能力尚需发展。