《Musical Spirograph》是一款结合万花尺图案与生成音乐的浏览器工具,用户可调整转子、手臂、音阶、合成器预设等参数,创造视觉与听觉的和谐体验。尽管音质一般且不支持MIDI输出,但其催眠般的几何图案和可玩性令人着迷。
作者分享了转向使用50年历史胶卷相机的经历,认为这是一种有效的摄影学习方式。尽管现代相机功能强大,但自动模式限制了学习。使用胶卷相机后,作者更加关注照片的构图和设置,意识到胶卷成本使得拍摄需谨慎。尽管胶卷相机有缺点,但提升了摄影技巧。
最近讨论的 Nano Banana 在还原手绘稿方面表现出色,尤其在构图和细节上更为稳健。通过具体提示词生成的角色更忠于原稿,尽管手部细节仍受源图模糊影响。整体体验验证了其高还原度,提示词的写法至关重要。
《用索尼相机拍好51个生活场景》介绍了拍照的基本技巧,包括对焦、防抖和构图。学习摄影需要多加实践,掌握光圈、快门和ISO,运用三分法等构图技巧能显著提升拍照水平。内容适合新手,易于理解。
完美海报设计应遵循清晰层次、平衡构图、合适字体和颜色的原则。突出主要信息,使用视觉元素支持主题,保持简洁,避免拥挤。设计时需考虑展示媒介,确保信息易读且引人注目。
NVIDIA推出AI蓝图,结合FLUX.1-dev、ComfyUI和Blender,优化RTX PC的图像生成流程。用户可通过3D草图控制生成图像,简化创作过程。该蓝图提供必要工具和文档,支持高性能生成,适合AI艺术家和开发者。
现代电影海报不仅是宣传工具,更是故事的视觉表达。设计师通过简约、霓虹和奇幻等风格,结合摄影、字体和布局,创造引人注目的海报。成功的海报应聚焦强烈的视觉概念,保持平衡的构图,选择经典字体,限制色彩,确保可扩展性,避免过度设计,并让故事引导设计。
这篇文章为初学者设计师介绍了UI/UX设计的基本原则,强调直观设计的重要性。讨论了构图、层次、对比、重复、平衡等关键技巧,帮助设计师创建清晰易用的界面。作者鼓励设计师在掌握规则后大胆创新。
艺术创作中,掌握绘画技巧对初学者和经验丰富的艺术家至关重要。基本技巧如笔触、色彩混合和构图能提升作品的质感与深度。通过层叠和透明涂层等高级方法,作品更具层次感。不断探索和完善技巧,有助于表达个人艺术视野。
CustomCrafter是一种新的视频生成方法,能够在保留原始运动和构图的基础上,结合用户提供的文本提示与现有视频,生成反映文本的新视频。
本研究解决了现有视觉表示学习在对象交互理解上的不足,特别是通过改善弱标记数据(如标题)来增强组合学习。研究表明,基于改进数据的标准对比学习模型,显著提升了在图像检索任务上的表现,超过了所有定制化架构。
谷歌Meet的自动构图功能现已向所有用户开放,用户在视频通话中可以自动居中,无需手动调整摄像头。该功能默认启用,用户可在通话前通过菜单关闭。与苹果的Center Stage类似,谷歌的版本不支持用户移动时的跟踪,减少会议干扰。
本文介绍了多示例学习框架下的弱监督技术,旨在自动识别视频概念并提取复杂语义中的弱标签。研究表明,在面部和动作识别任务中,该方法有效减少了手动标记工作,且放弃实例级别注释对性能影响微小。此外,研究还探讨了电影场景分割、视觉场景分析及无监督视频生成等领域的创新方法。
本研究提出了一种多模态引导的数字艺术生成方法MGAD,利用CLIP模型统一文本和图像模态,实验结果表明其在数字艺术生成方面有效。此外,UPainting模型通过预训练的Transformer和图像-文本匹配模型提高了图像生成的保真度。研究还介绍了多种图像合成和编辑技术,展示了艺术风格转移和用户交互生成的创新。
新造型主义是由蒙德里安和杜斯伯格创造的艺术风格,通过简单的构图和色彩形式来探索景象的基本原理。它对绘画、建筑、工业设计和平面艺术产生了重要影响。
好的摄影不仅仅取决于设备,构图、用光和表达决定性瞬间也很重要。
L2XGNN是一种可解释的图神经网络框架,能够学习解释性亚图,从而提高预测的可解释性和准确性。研究还提出了基于图形的自我监督学习方法MGSSL,展示了其在分子图信息捕获方面的优势。此外,研究介绍了多目标筛选方法和GNN解释器TAGE,均在多个任务中表现优异。
本研究探讨了图像检索中的多模态方法,提出了ComposeAE和SSN等新模型,利用深度学习提升图像与文本的匹配效果。实验结果表明,这些方法在多个数据集上优于现有技术,显著改善了检索性能。
该论文提出了一个从多个视角捕捉的无标注视频演示中学习视觉表示的框架,应用对比学习来增强与任务相关的信息和抑制特征嵌入中的无关信息。该方法在模拟几种机器人任务中得到验证,结果表明与现有方法相比,该方法水平更高,训练轮数更少。
完成下面两步后,将自动完成登录并继续当前操作。