DeepSeek has released a developer preview of DeepSeek Harness (dsh), an open-source execution runtime for building autonomous AI agents. The software features a micro-kernel architecture with...
Mojo🔥语言现已完全开源,采用Apache 2.0许可证(含LLVM例外)。其编译器、工具链及标准库源码已发布在Modular的GitHub仓库中。用户可通过Bazel命令从源码构建编译器或使用预编译版本。目前暂不接受编译器贡献,计划年底开放。此举旨在推动语言发展,吸引社区参与。
Modular在ModCon大会上宣布其AI平台已生产就绪,Mojo语言1.0全面开源(Apache 2.0),并与微软合作支持Windows。Modular Cloud正式上线,服务MiniMax等客户,扩展支持AWS Trainium、Google TPU及高通芯片,旨在构建异构计算统一软件基础,推动行业联盟。
Modular宣布将高通数据中心AI加速器(如Cloud AI 100和Dragonfly系列)集成到其平台,支持开发者用同一套软件栈运行于NVIDIA、AMD和高通芯片。通过Mojo和MAX框架,团队在不到六个月内成功部署Gemma 4模型,实现高性能推理,强调可移植性和快速集成。
Mojo语言正式发布1.0版本,标志着其从开发阶段迈向稳定、生产就绪的语言基础。该版本简化了语法,统一了变量声明和闭包等特性,并新增多项功能。社区贡献显著,近200名开发者提交了超1100个PR。未来计划包括开源编译器、增强异步编程等。同时,MAX平台也更新了安装方式和模型支持。
高通完成对AI软件公司Modular的收购,整合其AI原生软件平台,以提升跨设备、数据中心和边缘的AI解决方案性能与能效。Modular的Mojo、MAX等产品将继续运营,联合创始人Chris Lattner出任高通高级副总裁,推动开放异构生态,加速AI部署效率。
高通宣布收购Modular,以增强其在生成和智能AI领域的软件基础。Modular提供开放的AI软件平台,支持多种硬件架构,简化AI开发和部署。这次收购将提升高通在数据中心和边缘环境中的AI计算能力,推动AI技术的普及与创新。
Modular 26.4版本推出,支持MiniMax M3和GLM 5.2等前沿模型,增强了模型架构和API兼容性。新功能包括稀疏激活的Mixture-of-Experts(MoE)架构,提升了性能和开发体验。用户可通过Modular Cloud访问500多种模型架构,支持多种应用场景。
Modular 26.4版本推出,支持MiniMax M3和GLM 5.2等前沿模型,增强了模型架构和API兼容性。新功能包括稀疏激活的Mixture-of-Experts(MoE)架构,提升性能和开发体验。用户可通过Modular Cloud访问500多种模型架构,适用于多种应用场景。
Modular将在2026年8月18日在旧金山举办年度开发者大会ModCon,主题为解决硬件稀缺问题。会议将展示AI模型在不同硬件上的灵活运行,并介绍新软件发布。早鸟票价为299美元,7月1日后为450美元。
MiniMax M3是最新的开源模型,优化了编码和多模态任务。其稀疏注意力机制显著提高了计算效率,减少了每个令牌的计算需求,提升了速度。该模型在Modular平台上可供企业客户使用,支持实时患者对话的灵活推理。
Hippocratic AI与Modular结合,实现实时患者对话。Mojo 1.0 Beta正式发布,新增视频生成功能。社区积极参与,开发了多个项目,包括Mojo应用和科学库。
Modular在MLSys 2026大会上讨论了推理技术的最新进展,强调AI代理在低级代码生成中的重要性。会议展示了多种优化技术,如高效的KV缓存管理和异构硬件应用,以提升推理性能。Modular的架构支持跨组件优化,以适应行业需求的变化。
本文讨论了Modular Cloud的路由系统数据层,强调高效处理实时推理请求的重要性。通过分片位图和斐波那契哈希,系统能够在微秒级别内快速查询缓存状态,确保低延迟推理请求。同时,设计考虑了并发事件流的实时更新和主机生命周期管理,以优化性能和响应速度。
Modular发布了Mojo 1.0.0b1,展示了如何利用AI代理快速构建应用程序和库。开发者可以在几周内创建多个Mojo库和一个生产级应用,显著提高开发效率。该项目强调API设计的重要性,并通过一致的项目结构和测试模式,促进Mojo生态系统的快速发展。
Modular推出了Mojo语言,旨在提升现代AI编程效率。Mojo具有简洁的语法和强大的类型系统,能够在编译时捕捉错误,减少调试时间。用户可以通过AI代理技能快速将CUDA代码转换为Mojo,支持多种GPU架构。Mojo 1.0 beta版已发布,用户可利用这些技能加速Python代码或替换CUDA。
Modular推出了Gemma 4,旨在提升AI系统的响应速度。Tim Davis介绍了Inkwell,一个实时互动故事书应用,利用Modular Cloud实现快速文本和图像生成。通过优化推理层,Inkwell能在420毫秒内生成首个文本,并在6秒内完成插图,确保用户体验流畅,支持流式生成,减少等待时间,提升用户互动性。
Modular Cloud正在解决大语言模型(LLM)推理中的路由问题。传统负载均衡方法不适用于LLM,因为需要考虑状态、硬件特性和会话连续性。新的路由层能够根据缓存状态和硬件优化请求处理,支持多步骤执行,从而提升响应速度和效率。
Modular发布了Mojo 1.0测试版,标志着新语言时代的开始。此次更新包括视频生成、多GPU支持和简化的Mojo语法,旨在提升开发者体验并促进广泛采用。
Modular发布了Gemma 4,展示了AI编码代理在复杂系统工程任务中的能力。五个前沿模型成功重建了Wan 2.1文本到视频推理管道,证明了MAX图形API的有效性,并展示了调试和工程纪律的重要性,能够在新框架中构建完整的多模态推理系统。
完成下面两步后,将自动完成登录并继续当前操作。