本文推荐了适合巴西读者的编程书籍,涵盖多种语言和框架,强调可及性和本地化,包括《算法:理论与实践》、《C++数据结构与算法》和《Java:如何编程》,适合不同水平的学习者。
IberBench是一个新基准,旨在评估西班牙、葡萄牙及其地区语言的大型语言模型(LLMs)。它整合了101个数据集,涵盖22个任务,关注语言多样性和行业相关性。评估结果显示,LLMs在行业相关任务上表现不佳,尤其是加利西亚和巴斯克语言的模型面临更大挑战。
本研究解决了葡萄牙语变体识别中的不足,尤其是由于巴西葡萄牙语语料库的主导地位导致的语言偏见问题。我们提出了一种跨领域语言变体识别工具,采用变压器模型进行分类,并建立了 PtBrVarId 语料库以评估其有效性。研究结果表明,所开发的方法不仅适用于葡萄牙语,还能扩展到其他语言和变体,对未来相关研究具有重要影响。
本研究探讨了葡萄牙语开放信息提取中数据集不足的问题,建立了高质量的手动标注语料库并提出标注规则,验证了现有系统的性能,为该领域的发展提供支持。
2024年是我转变的一年。我和Jayz搬到里斯本,适应新生活,感受到自由与开放。尽管远离中国,我们仍关注家乡的现状。学习葡萄牙语让我更深入理解不同文化,信息消费习惯也转向更注重个人经验。未来,我将专注于融入葡萄牙文化,探索科技与人文学科的交汇,并以更自然的方式进行写作。生活的意义在于发现日常中的美。
2024年对我和家人来说是变革的一年,我们移居里斯本,学习葡萄牙语,关注中国现状。信息消费习惯的变化让我更重视个人经验,减少了博客更新。未来,我将探索科技与人文的交汇,提升葡萄牙语水平,注重写作质量。
本文介绍了一个包含91个编程逻辑练习的资源,旨在提升逻辑思维能力。练习使用C#实现,适合教学,提供清晰的解释,并有葡萄牙语版本。
本研究通过开发GigaVerbo语料库,解决了葡萄牙语神经文本生成资源不足的问题。新模型Tucano在多个基准测试中优于现有模型,突显了评估方法的局限性。
状态模式允许对象根据内部状态变化调整行为,看似改变类。适用于对象需根据状态表现不同行为的情况,如自动售货机的状态:等待投币、选择商品、商品出货。通过定义不同状态类,每个状态实现特定行为,简化代码管理和修改。
命令模式将请求封装为对象,使客户可以使用不同的请求、队列或可逆操作。它将执行逻辑与命令逻辑分离,适用于需要撤销和重做操作的场景。示例中,`ControleRemoto`通过调用`ComandoLigarLuz`和`ComandoDesligarLuz`来控制灯的开关。此模式提高了灵活性,便于定义、替换或撤销操作。
责任链模式用于将请求传递给一系列处理者,每个处理者决定是否处理或传递给下一个。适合多步骤或多责任系统,如费用审批。例子中,经理可审批1000以内,主任5000以内,总裁可审批任何金额。
装饰器模式可以动态为对象添加功能,而无需修改原类。适用于扩展功能而不改变代码或创建复杂子类。本文以通知系统为例,展示如何用装饰器模式实现邮件和短信通知。`INotificacao`接口定义发送操作,`NotificacaoEmail`类负责邮件通知,`NotificacaoSMSDecorator`在此基础上添加短信功能。
对象池模式通过重用昂贵或耗时的对象来提高系统效率,特别是在创建新对象代价高时。常用于管理数据库连接或图形渲染。`Conexao`类代表昂贵对象,`ConexaoPool`负责管理和提供连接。此模式有效管理资源,减少新对象创建,适合高性能系统。
本研究解决了葡萄牙语事件提取的特殊问题,主要由于缺乏任务特定的标注语料库。文中提出了一种框架,利用两个独立的BERT模型来识别和分类葡萄牙文档中的事件,最终取得了触发词分类64.4的F1分数和参数分类46.7的F1分数,为该领域建立了新的基准。
本研究解决了现有ACE-2005语料库在语言覆盖上的局限性,通过将其翻译为葡萄牙语以创建ACE-2005-PT语料库。研究中使用了自动翻译和多种对齐技术,最终达到70.55%和87.55%的对齐精度,成功生成了葡萄牙语版本的ACE-2005语料库,具有重要的实用价值。
该研究提出了一种多语言神经机器翻译模型,通过在输入句子开头添加标记来指定目标语言,保持模型框架不变。实验结果显示,该方法在翻译质量上优于传统统计系统,尤其在相似语言之间的翻译效果显著提升。此外,研究探讨了针对巴西葡萄牙语的语言模型评估和预训练方法,推动了葡萄牙语神经处理的发展。所有模型和数据集均可用于研究和商业用途。
本文提出了多种葡萄牙语神经编码模型,特别是基于RoBERTa架构的PeLLE模型系列,利用开放数据进行训练,并评估其在多个任务中的表现。同时,开发了支持欧洲和巴西葡萄牙语的Albertina PT-*编码器,推动语言技术研究。此外,研究探讨了无标注数据集的构建方法及其在多语言任务中的应用。
《敏捷流畅模型》电子书已推出葡萄牙语版本,感谢Renato Barbieri的翻译。他的书《敏捷简史》讲述了敏捷运动的历史,所有版税将捐赠给巴西南部洪灾受害者。
本研究提出了一种评估巴西葡萄牙文语言模型的方法,解决了模型的可解释性问题。开发了基础编码器模型,并提供开放的葡萄牙语数据集,展示了神经翻译系统的优越性。通过单语言预训练,模型在多个葡萄牙语数据集上表现优于多语言模型。此外,研究利用数据增强技术解决金融领域数据稀缺问题,并推出PT-Pump-Up工具以改善资源可访问性。
为促进葡萄牙语的神经编码和数字化时代技术准备,我们开发了一种名为 Albertina PT-* 的基于 Transformer 的编码器,并在欧洲葡萄牙语和巴西葡萄牙语方言的领域设立了最先进的技术水平。我们免费分发 Albertina PT-PT 和 PT-BR 并采用最宽松的许可证,以推动对葡萄牙语言技术的研究和创新。
完成下面两步后,将自动完成登录并继续当前操作。