英伟达与哈佛等团队提出Hydra-0,一种以动作流为条件的通用世界模型,将机器人动作表示为像素运动,统一跨本体、任务和环境的预测。该模型降低机器人运动误差90.4%,物体运动误差60.2%,支持零样本组合,并在RoboLab中预测成功率与真实结果高度相关(r=0.96),同时实现高效推理和真实世界验证。
Flow是一款美观、开源的在线EPUB电子书阅读器,支持在线使用或自部署,可离线运行。主要功能包括书内搜索、图片预览、自定义排版、高亮笔记、主题、链接分享、数据导出及Dropbox云端存储。开发中功能有快捷键、多语言等。数据存储于浏览器IndexedDB,可清除本地或远程数据。
Wispr AI完成2.8亿美元B轮融资,估值达20亿美元,并推出自研语音模型Canto。该模型能在嘈杂环境中识别语音,将错误率从30%降至5-10%。其产品Flow已处理超600亿字,被财富500强企业广泛使用,惠及商务人士及听障群体。
本文讨论Cilium/Hubble可观测性:Hubble flow提供连接级事件与verdict,metrics提供聚合计数,二者口径不同。全绿面板不代表无丢包,可能丢在未观测平面。排障应先定观测点,区分FORWARDED/DROPPED/REDIRECTED,注意采样、高基数、Relay延迟等盲区,结合Cilium agent与主机指标综合判断。
Tanzu Spring提供包含OpenJDK、Spring和Apache Tomcat的单一订阅服务,涵盖支持与二进制文件,用户可通过该订阅获取全面技术支持。
微软开源Mage-Flow,一款仅4B参数的紧凑图像生成模型,通过Tokenizer-Backbone-System设计,在图像生成和编辑上媲美20B-32B大模型,推理更快、显存更省。支持中英文文生图、指令编辑及Gradio交互,单张A100上1024×1024出图仅0.59秒,已在HyperAI上线供低成本体验。
本文介绍如何使用CodeQL库对Java程序进行数据流分析,涵盖本地数据流、全局数据流和污点跟踪。本地数据流分析单个方法内的数据传递,全局数据流追踪整个程序,污点跟踪扩展了非保值步骤。文章提供了配置类、谓词定义及示例查询,并附有练习题及答案,帮助用户编写自定义数据流查询。
本文介绍了数据流分析的核心概念,即数据如何在控制流图(CFG)的节点和边上流动。详细阐述了三种经典分析:到达定值分析(检测变量定义)、活跃变量分析(判断变量未来是否被使用)和可用表达式分析(识别可复用的计算结果)。每种分析都涉及数据抽象、转移方程、控制流处理及迭代算法,并说明了初始化策略和终止条件(不动点)。
本文介绍了如何在Java的CodeQL库中进行数据流分析,包括本地数据流、全局数据流和污点跟踪的实现。通过示例,读者可以学习编写数据流查询,追踪数据在程序中的流动,识别潜在的安全问题。
Keycloak 是一个开源的身份和访问管理解决方案,支持 OIDC、OAuth2 和 SAML 等企业级功能。尽管架构复杂,特别是在 Quarkus 时代,Keycloak 仍适合用于企业内部单点登录和产品附带的身份管理。文章分析了 Keycloak 的架构、配置、缓存机制及与 LDAP 的集成,强调了生产环境中的注意事项和常见问题。掌握 Keycloak 的工程复杂性对团队至关重要,以确保系统的稳定性和性能。
Tanzu Spring 提供对 OpenJDK、Spring 和 Apache Tomcat 的支持,用户只需简单订阅即可获得相关服务。
谷歌的新AI模型Omni可以将照片、视频和文本转化为其他形式,已在视频生成平台Flow中推出。Omni在生成视频时表现出色,但仍存在不一致和奇怪的结果,用户可能需要多次修改才能达到理想效果。尽管有所改进,制作真实感视频仍需努力,尚未达到完美。
谷歌推出了Google Flow和Google Flow Music,增强视频和音乐创作的AI功能。新工具Gemini Omni提供精准视频编辑,用户可用自然语言创建定制工具。Flow Music允许艺术家精细编辑歌曲并与Omni Flash合作制作音乐视频。此外,移动应用程序也已推出,方便用户随时创作。
本周GitHub十大开源项目聚焦语音AI与自进化智能体。微软的VibeVoice凭借声音克隆和长音频转录技术位居榜首,字节跳动的deer-flow是支持自主学习与任务分解的通用智能体框架。Hermes Agent实现自我进化记忆,提升AI助手体验。其他项目如last30days-skill和Deep-Live-Cam展示了跨平台研究与实时换脸技术,整体趋势表明AI能力获取门槛降低,推动创新与普及。
Nicole Forsgren discusses the "AI Productivity Paradox", explaining why generating code faster often makes deployment bottlenecks more expensive. She shares the DevEx framework to help architects...
Flow推出新界面,整合图像生成与视频编辑,简化创作流程,用户可通过自然语言精确编辑,提升创作体验。
Autodesk起诉谷歌,指控其AI视频生成工具“Flow”侵犯Autodesk商标,可能导致消费者混淆。Autodesk于2022年推出“Flow”品牌产品,谷歌在2025年推出类似工具后,要求其停止使用该名称,并请求法院禁止谷歌使用该商标。
谷歌已将其AI视频制作工具Flow的使用范围扩大至Business、Enterprise和Education Workspace用户。Flow可以根据文本提示或图片生成八秒视频片段,并允许用户调整光线和镜头角度等设置。最近,谷歌还增加了对垂直视频和音频的支持。
何恺明团队提出的双向归一化流(BiFlow)框架有效解决了传统归一化流生成效率低的问题,通过解耦前向与逆向过程,生成速度提升了两个数量级,实验结果在ImageNet上表现优异。该项目由三位来自清华和MIT的本科生主导。
Flow推出新功能,帮助创作者更精确地编辑视频和图像。用户可通过Nano Banana Pro生成和编辑图像,手绘提示,插入或移除对象,调整摄像机运动,提升创作灵活性与控制力。
完成下面两步后,将自动完成登录并继续当前操作。