DaVinci Resolve 21.1发布,为Linux用户带来重大更新,新增AI助手集成,支持Claude、ChatGPT Codex等工具,可整理媒体、批量渲染和删除片段,同时改进多机位工作流和图形工具,扩展摄像机支持,是原生Linux视频编辑的领先方案。
OpenShot 4.0 正式发布,主要升级至 Qt6 工具包,带来大量代码调整和界面改进,如新增录制视图、音频录制面板及实时多资源录制时间线预览。同时加入音频降噪、阴影发光效果、分析视图、胶片颗粒预设、YOLOv5 对象检测等新功能,并优化了 Windows 版本。用户可在 GitHub 获取源码和二进制文件。
MiniMax H3是2026年8月发布的通用多模态视频生成模型,能理解文本、图像、视频和音频,根据描述生成最高2K分辨率、15秒时长、带立体声的视频。它支持文本生成、图像参考、视频编辑等多种方式,引入多项技术提升质量和效率,可应用于广告、电商、影视等领域。HyperAI平台已支持在线体验和部署。
Google Flow推出Gemini Omni 1.1 Flash更新,新增视频编辑功能:支持起始和结束帧控制,保持角色叙事一致;可导出1080p或4K高清视频;支持360p快速草稿预览,再升级至720p下载。这些功能现已上线,旨在帮助创作者制作更精致、专业的视频。
Google DeepMind推出Gemini Omni模型,首个版本Omni Flash支持通过对话生成和编辑视频,简化创作流程。团队访谈强调其多功能性,未来将不断改进,潜力无限。
谷歌发布Gemini Omni Flash模型,支持通过对话生成和编辑视频,可切换视角、改变场景、动画化物体、应用不同风格。开发者已展示多种应用,如多角度拍摄、日夜转换、草图动画化等。该模型结合物理理解与真实世界知识,输出更逼真,现已在Gemini应用、Google Flow等平台开放使用。
字节跳动Seedance 2.5现已在AI Gateway上线,可生成最长30秒视频,支持镜头运动与连续性,无需后期拼接。支持文本、视频、图像和音频输入,可编辑已生成视频,支持十多种语言提示。提供代码示例展示视频生成、图像引用和视频编辑功能。
WebCut正在开发AI剪辑功能,用户可以通过对话进行视频编辑,无需界面操作。这一功能将提取WebCut的操作作为工具,确保系统灵活扩展,提升用户体验。
Google Photos推出了Video Remix功能,用户可以轻松将普通视频转变为精彩瞬间。该功能提供多种模板,支持电影级重光、背景更换和艺术效果。目前已向部分Google AI Plus、Pro和Ultra订阅用户推出。
FFmpeg在移动端集成面临交叉编译、JNI桥接和API复杂性等挑战。本文介绍了如何使用Claude Code创建跨平台的FFmpeg视频编辑封装,支持裁剪、旋转、缩放和倍速播放等功能,简化命令行操作,并提供了Android和iOS的具体实现示例及注意事项。
X平台推出新的视频编辑和录制工具,旨在减少用户盗用视频的现象。新工具包括多语言字幕和绿幕功能,鼓励原创内容创作,并提高不发布重复内容创作者的曝光率。
谷歌推出了Nano Banana 2 Lite和Gemini Omni Flash两个新模型,旨在加速图像生成和视频编辑。Nano Banana 2 Lite是高效的图像模型,适合高吞吐量需求;Gemini Omni Flash支持高质量视频生成和对话式编辑,允许用户通过自然语言修改视频。这两个模型结合使用,可实现快速的多媒体创作。
谷歌推出了Nano Banana 2 Lite和Gemini Omni Flash两个新模型。Nano Banana 2 Lite是一款高效的图像生成工具,适合快速原型设计;Gemini Omni Flash则支持视频生成和编辑。两者结合可提升多媒体创作的开发效率。
浙江大学和腾讯团队提出了JAVEdit-100k数据集及评测基准JAVEditBench,填补了音视频联合编辑的空白。研究表明,JAVEdit在评测中表现优异,音视频同步性提升26%。该工作为多模态编辑提供了高质量资源,并指出音频基础模型的不足,未来需加强音频编辑能力。
六月Pixel更新推出新功能,包括实时屏幕反应、视频编辑工具Gemini Omni、音乐生成和浮动窗口多任务处理。Voice Translate功能扩展至Pixel 10a,支持多语言实时翻译。紧急共享功能增强,自动通知紧急联系人。Google Photos新增“Ask Photos”功能,用户可通过自然对话编辑照片。
字节推出了开源视频生成与编辑框架Bernini,强调“先理解再生成”。该框架利用多模态大模型进行语义理解,并通过扩散模型实现高质量渲染,解决视频编辑中的一致性和自然性问题。Bernini支持多种编辑选项,如天气、风格和焦点,能够处理复杂视觉效果,提高创作的可控性和稳定性。
在2026年Google I/O大会上,谷歌发布了Gemini Omni和Gemini 3.5模型。Gemini Omni允许用户通过自然语言编辑视频,生成高质量的视频内容;而Gemini 3.5 Flash则专注于执行复杂任务,提升智能代理的能力,支持多步骤工作流程。这些新功能将为用户提供个性化的AI体验,帮助管理日常任务,并提升搜索和应用的智能化水平。
苹果最新的MacBook Air在纪念日促销中降价200美元,13英寸型号售价899.99美元,15英寸型号售价1099.99美元。M5芯片性能优越,适合日常使用,电池续航约13小时,显示效果出色,适合轻度视频编辑和多任务处理。
在线视频编辑器Yuzzit推出了新工具Smart Clip,利用人工智能分析长视频,自动生成片段选择集,包括评分、标题和标签。该工具旨在提升新闻编辑室和社交媒体团队的工作效率,客户发布视频片段的数量平均增加三倍。
Nano Banana推出了Gemini Omni,结合图像生成与编辑能力,用户可通过自然语言编辑视频,生成高质量内容。Omni支持图像、音频和文本输入,能够创建真实感强的场景,并具备物理推理能力。首个模型Gemini Omni Flash已上线,未来将扩展更多功能。
完成下面两步后,将自动完成登录并继续当前操作。