小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Broadpeak推出多视角即服务,加速多路直播体育赛事体验

Broadpeak推出Multiview即服务,通过SaaS平台提供多视角直播功能,降低部署成本与复杂度,支持用户自定义布局同时观看多个频道或摄像机角度。该服务无需前期资本支出,按使用量付费,由专家团队监控性能,旨在提升观众参与度并减少流失,将于IBC2026展示。

Broadpeak推出多视角即服务,加速多路直播体育赛事体验

实时互动网 实时互动网 · 2026-08-21T03:04:20Z
活动回顾|从编译优化到场景应用,多视角剖析 Agent 时代的 AI Compiler 技术创新与落地经验

该文报道了一场AI编译器技术分享活动,多位专家围绕编程语言、算子优化与推理执行展开讨论。内容涵盖Triton-TLE语言扩展、TileRT低延迟推理、FalconGEMM矩阵乘法优化、AscendNPU IR开源及具身智能编译器,旨在促进技术交流与社区建设。

活动回顾|从编译优化到场景应用,多视角剖析 Agent 时代的 AI Compiler 技术创新与落地经验

HyperAI超神经 HyperAI超神经 · 2026-08-20T09:42:56Z
Sky 推出”You Multiview”(你的多视角)

Sky推出“Your Multiview”功能,允许用户在同一屏幕同时观看最多四场Sky Sports直播赛事,覆盖英超、F1、板球等。该功能于8月21日英超回归时上线,适用于Sky Glass、Stream和Q设备,支持调整布局、切换音频和全屏观看。Sky本赛季播出超1500场比赛,旨在提升球迷观看体验。

Sky 推出”You Multiview”(你的多视角)

实时互动网 实时互动网 · 2026-08-20T02:31:02Z
MVICAD2:具有延迟和扩张的多视角独立成分分析

本文介绍MVICAD2方法,用于多视角独立成分分析,允许不同受试者的脑信号源存在时间延迟和扩张,以处理个体差异。该方法通过闭式似然近似和优化提升性能,模拟实验显示优于现有方法,并在Cam-CAN数据集中验证了延迟和扩张与衰老的关联。

MVICAD2:具有延迟和扩张的多视角独立成分分析

Apple Machine Learning Research Apple Machine Learning Research · 2026-08-18T00:00:00Z
Codette:具有记忆和元认知策略演化的多视角认知架构

Codette是一种多视角认知架构,通过六个不同性格的AI专家协作解决复杂问题,性能比单一AI提升近一倍。它利用“茧”记忆系统,在积累951个记忆单元后实现质变,并内置AEGIS道德陪审团增强伦理判断。该架构将思考与表达分离,仅用80亿参数模型和普通显卡,就在GPQA测试中显著提升准确率,展示了高效智能进化的新路径。

Codette:具有记忆和元认知策略演化的多视角认知架构

极道 极道 · 2026-08-11T10:02:00Z
五大高校联手发榜!首份机器人三视角世界模型评测结果出炉,榜单持续更新中

北京大学等高校联合发起TriWorldBench Challenge,推出首个机器人三视角世界模型评测榜单。首周CASIA-DRL、同济、Fysics AI模型位列前三。榜单评估多视角一致性、任务执行和物理理解,包含500个episode和19项指标,旨在推动世界模型从视觉生成向世界理解发展,并为研发提供改进方向。

五大高校联手发榜!首份机器人三视角世界模型评测结果出炉,榜单持续更新中

量子位 量子位 · 2026-08-11T00:46:23Z
科学家选理论居然看颜值?三视角主义撕开科学潜规则

科学家选理论常凭审美直觉,而非纯客观数据。三视角主义揭示美在科学中的核心作用,如日全食巧合比例、广义相对论因数学之美先被接受等例证表明,美是科学发现的导航仪,抽掉它现代物理大厦将崩塌。科学并非纯客观,审美标准与艺术共通。

科学家选理论居然看颜值?三视角主义撕开科学潜规则

极道 极道 · 2026-07-22T21:51:00Z
RayRoPE:用于多视角注意力的投影射线位置编码

RayRoPE是一种针对多视角Transformer的位置编码方法,利用预测的射线点进行几何感知编码,通过查询帧投影坐标实现SE(3)不变性和多频相似性,并处理预测不确定性。实验表明,该方法在新视图合成和立体深度估计任务上优于现有方案,在CO3D数据集上LPIPS指标提升15%,且能有效整合RGB-D输入。

RayRoPE:用于多视角注意力的投影射线位置编码

Apple Machine Learning Research Apple Machine Learning Research · 2026-07-20T00:00:00Z
多视角视频市场格局:流媒体架构如何决定成败

Multiview技术使观众能够在同一屏幕上同时观看多个直播信号,是体育直播的核心能力。其成功与否取决于流媒体架构,主要有三种方案:服务端合成、客户端合成和打包器侧合成。服务端方案兼容性强但成本高,客户端方案灵活性高但对设备要求高,打包器侧方案在二者之间取得平衡。选择架构时需考虑设备覆盖、个性化需求和成本。

多视角视频市场格局:流媒体架构如何决定成败

实时互动网 实时互动网 · 2026-07-07T09:16:07Z

本文探讨了SQL查询优化中的裁剪链路,分析了Trino、Spark和DuckDB在处理Iceberg表时的不同策略。通过四层漏斗模型,描述了SQL谓词到布局约束的转化过程,以及各引擎在规划和执行阶段的职责分工。实验结果表明,优化器能够有效减少扫描的数据量,提高查询效率。

【分布式 OLAP 查询引擎】Iceberg 下推全链路:Planner 视角

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-07-07T00:00:00Z
赛事直播多视角功能:选型逻辑与成本权衡

多视角直播已成为赛事观众的需求,主要有三种实现路径:多路独立推流、单流多Track和主视角流加交互选择通道。每种方案在成本、延迟和兼容性上各有优劣。电竞适合多路独立流,而大型球赛则更适合主视角加副视角的按需拉流。选择方案时需考虑传输成本和客户端同步开发成本。

赛事直播多视角功能:选型逻辑与成本权衡

实时互动网 实时互动网 · 2026-06-27T00:36:19Z
MetaSKILL 与 SKILL:多视角深度综述 - 张善友

2025年,Anthropic推出Claude Code中的Agent Skills概念,SKILL.md模块化能力包迅速成为AI代理生态的基础。截至2026年2月,公开的Skill数量超过28万个,MetaSKILL发展出生成、编排和多步工作流三层含义。核心争议包括SKILL的能力提升、自生成Skill的有效性及生态安全性。MetaSKILL作为操作系统,解决了执行可靠性、人工介入和审计追踪等问题,推动了AI技能的工程化发展。

MetaSKILL 与 SKILL:多视角深度综述 - 张善友

张善友 张善友 · 2026-06-23T08:51:00Z

在香港,新界地区骑共享单车的条件较好,主要有LocoBike和HelloRide两家共享单车服务。骑行时需遵守交通规则,推荐的骑行路线包括荃湾至屯门和上水至河上乡。骑行前应了解导航工具和停车规定,以确保安全和便利。

在香港骑共享单车:访客视角的经验分享

少数派 少数派 · 2026-06-17T03:08:23Z
介绍Snowflake与AWS的定制视角,适用于AWS良好架构框架

Snowflake与AWS的定制框架整合了两者的最佳实践,简化了安全、可靠性和性能优化等七个支柱的评估。通过统一审查流程,团队能够更高效地管理安全控制、数据治理和合规性,提升生产准备度。该框架支持多种访问方式,帮助用户在AWS和Snowflake环境中优化架构,降低成本并提高可持续性。

介绍Snowflake与AWS的定制视角,适用于AWS良好架构框架

AWS Architecture Blog AWS Architecture Blog · 2026-06-10T15:06:00Z
HumanEgo——从半小时人类第一视角视频中进行零样本学习的4大关键点:对人类手臂进行图像修补、将每只手和每个物体编码为一个交互中心Token、流匹配策略、稠密辅助目标

HumanEgo框架通过人类第一视角视频学习机器人策略,成功解决了人类与机器人之间的具身鸿沟。研究者利用佩戴的Aria眼镜采集示范数据,实现了零样本迁移,平均成功率达到92.5%。该方法无需机器人数据,数据高效,支持在新环境中稳健迁移,显著提升了机器人操作效率。

HumanEgo——从半小时人类第一视角视频中进行零样本学习的4大关键点:对人类手臂进行图像修补、将每只手和每个物体编码为一个交互中心Token、流匹配策略、稠密辅助目标

结构之法 算法之道 结构之法 算法之道 · 2026-06-08T15:46:32Z
从任意视角探索场景:3D体积视频技术突破意味着3D流媒体可能很快成为现实

布朗大学研究人员推出了名为PackUV的3D体积视频处理方法,旨在实现可存储、流式传输的逼真3D视频。该技术通过多台摄像机拍摄场景,并利用算法重建三维空间,允许从任意角度观看。研究团队克服了视频文件大小和流媒体传输的挑战,使其与现有视频编解码器兼容,推动3D视频在娱乐和制造业等领域的应用。

从任意视角探索场景:3D体积视频技术突破意味着3D流媒体可能很快成为现实

实时互动网 实时互动网 · 2026-06-03T03:51:48Z
τ0-WM——智元的视频-动作世界模型:组合“遥操、umi、人类第一人称视角”数据,未来视觉Latent助力动作生成,然后重新加噪去噪,若自洽取表现最好者直接执行,否则模拟推演找出最佳视觉指引重新生成

研究者提出了一种名为τ0-World Model(τ0-WM)的统一视频-动作世界模型,旨在提升机器人操作的预测能力。该模型结合视频预测、动作生成和任务评估,利用27,300小时的多样化数据进行训练。τ0-WM通过共享的预测网络,提供视频动作模型和动作条件视频模拟器两个接口,优化机器人在执行前的决策过程。

τ0-WM——智元的视频-动作世界模型:组合“遥操、umi、人类第一人称视角”数据,未来视觉Latent助力动作生成,然后重新加噪去噪,若自洽取表现最好者直接执行,否则模拟推演找出最佳视觉指引重新生成

结构之法 算法之道 结构之法 算法之道 · 2026-06-01T04:30:18Z

CUPID框架强调代码质量应关注五个属性:可组合、Unix风格、可预测、地道和领域驱动。Clojure通过不可变数据和纯函数实现可预测性,鼓励使用社区惯用写法,支持函数组合和管道操作,强调业务语言在代码中的重要性。关注这些属性能有效提升代码质量。

读:CUPID——从 Clojure 视角看代码设计

暗无天日 暗无天日 · 2026-05-26T00:00:00Z
嵌入式音视频开发学习路线图谱详解:工程师视角的全栈路线

本文系统拆解了嵌入式音视频开发学习路线图,涵盖基础知识、底层驱动、编解码、流媒体协议和AI应用等内容。强调需建立系统链路思维,掌握从底层驱动到产品化的完整流程,目标是独立完成稳定的音视频产品开发。

嵌入式音视频开发学习路线图谱详解:工程师视角的全栈路线

实时互动网 实时互动网 · 2026-05-20T03:00:04Z

椭圆曲线密码学(ECC)是现代密码学的重要基础,广泛应用于TLS和比特币等领域。本文探讨了椭圆曲线的数学原理,包括Weierstrass方程、点加法、群结构及标量乘法算法。重点介绍了Curve25519和Ed25519的设计选择及其在ECDSA签名中的应用,强调了安全性和实现的简便性,并讨论了ECC在实际应用中的优势及潜在的工程陷阱。

椭圆曲线算术:群论视角

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-05-20T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码