小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
可解释的文本分类:探析Scikit-LLM嵌入空间

本文介绍如何利用Scikit-LLM和本地Ollama模型生成电影评论嵌入,训练逻辑回归分类器评估质量,并通过UMAP降维可视化语义结构,最后使用SHAP值识别关键嵌入维度,以提升LLM文本分类的可解释性。

可解释的文本分类:探析Scikit-LLM嵌入空间

MachineLearningMastery.com MachineLearningMastery.com · 2026-08-28T12:00:50Z

本文介绍SSVC(利益相关者特定漏洞分类)作为CVSS的替代方案,通过决策树而非单一评分来指导漏洞处理。作者发布了Perl实现SSVC.pm,支持CISA等六种方法论,并演示了结合NVD数据计算CVE-2021-44228(Log4Shell)的实例,强调SSVC需结合环境因素做出针对性决策。

SSVC.pm:CPAN上的利益相关者特定漏洞分类

blogs.perl.org blogs.perl.org · 2026-08-07T03:00:00Z
扩展分类流映射

本文研究了将分类流映射(CFM)方法扩展到大规模语言建模。作者训练了17亿参数的流模型,通过自蒸馏实现仅需4步推理即可生成高质量文本,并保持接近数据级的熵。他们还提出了半离散设置下的似然界,用于标准语言模型基准评分,结果与离散扩散方法相当。文章还探讨了大规模训练中的挑战,并提供了损失加权和时间调度的实用建议。

扩展分类流映射

Apple Machine Learning Research Apple Machine Learning Research · 2026-08-07T00:00:00Z

Elastic 9.5正式发布,推出列式存储模式、VectorDB索引模式与自动校准,提升存储效率与向量搜索性能。新增Agent Builder增强、AI原生Kibana、原生Prometheus支持及安全功能Alert Zero,强化可观测性与安全运营,助力开发者构建AI智能体并简化数据管理。

Elastic 9.5:列式存储、VectorDB 索引模式和自动校准,以及 AI 驱动的警报分类

Elastic Blog Elastic Blog · 2026-08-04T00:00:00Z

Elastic 9.5正式发布,新增列式存储模式、向量数据库索引模式及自动校准,提升存储与查询效率。安全方面推出AI驱动的攻击发现与告警分类,助力实现“告警清零”。可观测性支持原生Prometheus与PromQL,简化迁移。Agent Builder增强监控与人工审批,Kibana支持AI生成仪表盘,整体提升数据管理、AI代理构建及安全运营能力。

Elastic 9.5:列式存储、向量数据库索引模式与自动校准,以及AI驱动的告警分类

Elastic Blog - Elasticsearch, Kibana, and ELK Stack Elastic Blog - Elasticsearch, Kibana, and ELK Stack · 2026-08-04T00:00:00Z

《奥德赛》是全球首部全程用65mm IMAX胶片拍摄的电影,导演诺兰推荐1.43:1画幅的70mm胶片版。文章详解IMAX影厅分类:GT胶片厅最顶级,Laser GT可放1.43:1数码版,激光厅分CoLa和XT,Xenon最差。国内最高只能看1.43:1数码版,选厅需注意银幕比例和放映系统。

从《奥德赛》观影聊聊 IMAX 影院的分类

少数派 少数派 · 2026-07-28T07:00:00Z
将文档分类扩展到10万+标签

Databricks 测试了三种大规模文本分类方法:纯向量搜索、向量搜索结合AI Classify、直接调用前沿大模型。结果显示,向量搜索加AI Classify的工作流在35,000至100,000标签的基准测试中,准确率达0.81,比最强直接模型高5个百分点,成本仅为后者的百分之一,且无需重新训练,是成本与质量的最佳平衡。

将文档分类扩展到10万+标签

Databricks Databricks · 2026-07-20T18:15:00Z

垃圾分类在实际生活中难以落实。作者观察小区居民几乎都混扔垃圾,分类政策执行困难,因门槛高(如厨余需处理汤水、塑料袋分离)且家庭缺乏分类设施。相比之下,国外“瓶子换钱”模式目标明确、激励强,更有效。作者建议由专人值守垃圾点协助分类,既降低难度又增加就业,认为当前倡导自发分类对个人而言太难。

垃圾分类,我真的做不到

特立独行的异类 特立独行的异类 · 2026-07-20T14:04:00Z
谷歌发布 TabFM-1.0.0-PyTorch:专为混合表格数据打造的零样本预测模型;跨越亚美欧!NVIDIA 开源多国合成人物数据集,千万级角色数据上线

TabFM 是 Google Research 发布的基础模型,专注于处理结构化表格数据,支持分类和回归任务。该模型通过上下文学习重塑表格预测,显著提升数据处理效率,并在零样本配置下超越多个传统基线模型。

谷歌发布 TabFM-1.0.0-PyTorch:专为混合表格数据打造的零样本预测模型;跨越亚美欧!NVIDIA 开源多国合成人物数据集,千万级角色数据上线

HyperAI超神经 HyperAI超神经 · 2026-07-17T10:18:20Z
在Databricks上通过专门代理扩展安全警报分类

Databricks通过安全湖仓处理大量安全日志,自动化分类和升级低严重性警报,显著提高了警报的准确性,确保每个警报都得到审查。该系统利用机器学习和实时数据流,优化安全运营,提升分析师工作效率。

在Databricks上通过专门代理扩展安全警报分类

Databricks Databricks · 2026-07-06T18:00:00Z

本文讨论了如何在WordPress中仅显示顶级分类的文章,排除子分类文章。通过在functions.php中添加特定代码,可以修改主查询,确保只查询指定的一级分类。提供了两种实现方法,以避免主题干扰。

WordPress分类列表只显示“顶级分类文章”,不包含子分类文章 实现代码

付杰博客 付杰博客 · 2026-06-29T07:46:05Z
站点升级手记 06:内容系统升级,采集、分类和转载边界

文章讨论了内容系统的升级,强调合理的采集和分类可以保持站点活跃并提供高质量技术信息。升级后,内容分类将更加灵活,确保信息来源多样化,并明确标注转载信息以保护版权,目标是更好地组织信息,帮助读者快速获取重要内容。

站点升级手记 06:内容系统升级,采集、分类和转载边界

mongona news mongona news · 2026-06-26T09:11:30Z
人工智能时代的隐私意识基础设施:资产分类案例研究

在人工智能时代,隐私意识基础设施需要准确的数据分类以有效实施隐私控制。文章探讨了通过构建丰富的上下文、利用大型语言模型处理模糊性,以及将稳定行为转化为确定性规则来应对数据分类的挑战。强调人类在关键决策中的重要性,并提出七个原则以确保分类系统的可靠性和可审计性,最终目标是实现高效的隐私保护与合规性。

人工智能时代的隐私意识基础设施:资产分类案例研究

Engineering at Meta Engineering at Meta · 2026-06-25T22:30:51Z
微调6亿参数Qwen3 4B实现91.6%分类准确率

通过微调6亿参数的小模型Qwen 3 0.6B,家庭问题分类准确率从9.92%提升至91.6%。关键在于让模型学习无意义的代码,降低认知负担,提升分类效果。这一策略适用于特定领域的AI应用。

微调6亿参数Qwen3 4B实现91.6%分类准确率

极道 极道 · 2026-06-22T02:47:00Z
大脑预测加工理论:分类完全“根植”在我们的神经结构中

文章探讨了大脑的分类机制,认为分类是感知的起点而非终点。大脑通过预测加工节省能量,主动猜测感官输入,形成对世界的理解。这一理论解释了颜色感知、疼痛体验及精神疾病的成因,强调感知是大脑构建的结果,而非客观现实。

大脑预测加工理论:分类完全“根植”在我们的神经结构中

极道 极道 · 2026-06-15T01:45:00Z

零信任数据安全强调保护数据而非仅依赖网络和身份验证。其关键原则包括最小权限数据库授权、应用层加密和有效的密钥管理。数据分类标签有助于细化访问控制,确保敏感数据的安全。通过分离数据加密密钥(DEK)和密钥加密密钥(KEK),并实施严格的身份验证,进一步增强数据保护。

【零信任安全架构】零信任数据安全:加密、分类与数据访问治理

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-06-12T00:00:00Z
使用Scikit-LLM进行多标签文本分类

本文介绍了如何使用scikit-LLM库进行多标签文本分类,利用大型语言模型(LLM)进行零-shot推理,无需标记训练数据。文章阐述了多标签分类的定义及其重要性,配置scikit-LLM的方法,以及如何加载真实数据集进行情感预测。通过示例,展示了为文本分配多个情感标签的简便性和高效性。

使用Scikit-LLM进行多标签文本分类

MachineLearningMastery.com MachineLearningMastery.com · 2026-06-11T12:00:17Z

在数字化办公时代,企业文档管理面临挑战。有效的文档安全策略应通过分类分级和密级标识实施,将文档分为五个安全等级,并制定相应保护措施,以提高效率、降低风险并确保合规。实施后,文档的安全等级与敏感程度精准匹配,形成有效的防泄密体系。

企业文档安全最佳实践(一):告别混乱,从“分类分级与密级标识”开始

绿盟科技技术博客 绿盟科技技术博客 · 2026-06-06T01:36:26Z
基于220种海洋细菌,科学家用基因组尺度模型重构异养微生物分类体系,挖出8类代谢菌群

研究揭示海洋异养微生物的代谢生态位,打破传统的富营养型与寡营养型二分法,提出8类代谢菌群。通过基因组分析,阐明其生长规律与资源竞争,推动全球碳循环研究,为生物地球化学模型提供新思路。

基于220种海洋细菌,科学家用基因组尺度模型重构异养微生物分类体系,挖出8类代谢菌群

HyperAI超神经 HyperAI超神经 · 2026-06-05T05:20:06Z
读:LLM Agent 入门——经典 Agent 分类与 LangChain/LangGraph 实践

本文介绍了LLM Agent的分类与实现,涵盖五种Agent类型及其核心机制。通过LangChain和LangGraph框架,展示了从简单反射Agent到基于目标和效用的Agent的复杂化过程。强调了Agent设计中的感知、决策和行动循环,以及根据问题复杂度选择合适工具和框架的原则。最后总结了Agent分类的连续性和框架与复杂度的匹配。

读:LLM Agent 入门——经典 Agent 分类与 LangChain/LangGraph 实践

暗无天日 暗无天日 · 2026-05-30T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码