神云科技在ISC 2026展示了多款液冷AI伺服器,以满足资料中心的需求。主要产品包括:MiTAC G4826Z5(搭载8颗AMD GPU,适合大规模AI基础架构)、MiTAC C2811Z5(符合OCP规范的多节点伺服器)、MiTAC G4520G6(支持Agentic AI框架)、MiTAC M2810Z5(优化云端运算)和MiTAC GS73-B8056(针对主流云端应用设计)。
DigitalOcean致力于为下一代AI提供高性能基础设施,专注于在AMD GPU上托管大型语言模型(LLMs)。通过深度优化软件堆栈,显著提升了推理性能并降低了成本。研究表明,优化硬件与软件的互动可以提高效率,未来将发布针对不同前沿模型的技术优化分析。
神雲科技在COMPUTEX 2026展出52U液冷机柜,支持多样化工作负载,能够搭载96颗AMD GPU,提升算力密度50%,占地减少33%。金刚石散热服务器降低能耗,节省数据中心成本。公司还推出扩展性强的机柜解决方案及基板管理控制器,提升数据中心运营效率。
本文介绍了如何在AMD GPU上运行ERNIE-Image。通过ROCm和Hugging Face Diffusers,用户可以在Docker环境中部署,步骤包括拉取Docker镜像、安装依赖、准备模型权重和运行推理。ROCm兼容CUDA接口,简化了模型部署过程,使开发者在非CUDA环境中也能使用主流框架进行图像生成。
Blender 5.1将于2026年3月17日发布,新增AMD GPU光线追踪支持、增强Vulkan支持、提升动画系统性能及新图像格式。GPU渲染性能提升5%-10%,CPU渲染提升5%-20%。
AMD GPU 导致桌面频繁死机,确认是 Panel Self Refresh (PSR) 功能的已知 bug。通过修改内核参数并重启系统,成功禁用 PSR,问题得到解决,笔记本恢复稳定。
2025年11月16日,Hacker News报道了多个重要话题,包括AI生成的世界时钟、对Archive.today的调查、欧盟聊天监控提案、贫困与经济困境的区别、安全通信应用Bitchat、爱泼斯坦档案数据库、Go语言进展、TCP协议的重要性、对学校午餐工作者的致敬,以及AMD GPU在AI计算中的潜力。
Modular Platform 25.4正式支持AMD GPU,提升AI模型性能,降低成本,增强灵活性。新增Mojo与Python绑定,简化开发流程,欢迎开发者贡献,共同推动AI基础设施发展。
2024年初,AMDGPU Linux内核驱动程序将启用Video Core Next 5.0,支持Radeon RX 9000 GPU。RADV驱动程序与Mesa 25.2结合,提供VCN5视频编码/解码支持,允许Navi 4x GPU通过Vulkan API加速视频,预计8月稳定发布。
vLLM 是一个加速大语言模型推理的框架,解决了内存管理瓶颈,支持 AMD GPU,适用于 ROCm 6.1。可通过 Docker 或源代码构建,安装依赖后可进行优化,支持多种模型。
just是一个跨平台的命令管理工具,提供详细的错误信息和环境变量加载功能。Iggy.rs获得认可,目标包括分布式共识和S3存储。Rust分析器更新了多个功能,讨论了Web客户端使用Rust或TypeScript的优缺点。CubeCL 0.3版本增强了对AMD GPU的支持,提升了性能。
随着AI模型参数增加,算力需求也在增长。Felafax公司通过简化AI训练集群,将训练成本降低了30%。他们使用JAX在AMD GPU上微调LLaMA 3.1 405B模型,展示了JAX在非英伟达硬件上的优势。JAX支持多硬件并行,适应性强,迁移方便。Felafax利用JAX的设备网格功能进行参数分片,优化内存和计算效率,并通过LoRA技术减少可训练参数,实现高效微调。相关代码已开源,并提供详细教程。
1. SCALE工具包允许开发人员在AMD GPU上原生编译CUDA程序,无需修改。2. Firefox 128版本默认收集用户数据,引发隐私担忧。3. Mistral AI发布了支持代码生成和具有线性时间推理能力的Mamba2语言模型。4. Exo项目允许用户使用家用设备构建AI集群,并支持各种流行模型。5. 免疫疗法通过编辑T细胞DNA治疗癌症,带来新的希望,尽管面临挑战。
本文介绍了如何在单个AMD GPU上使用ROCm运行Vicuna 13B模型,并使用GPTQ技术减少内存占用。提供了详细步骤和模型指标比较,帮助读者更好地了解如何释放这个先进的语言模型的全部潜力。
完成下面两步后,将自动完成登录并继续当前操作。