➡️
继续阅读
-
SenseNova-U1.5-8B-MoT 统一生成与理解,解锁原生多模态创作;DeepSeek-V4-Flash-Vision-Exp 拓展视觉理解新能力
商汤科技发布SenseNova-U1.5-8B-MoT统一多模态模型,支持图像生成、编辑与理解,提升4K画质和文字渲染。HyperAI官网更新数据集、教程...
-
开源dsh-image-gen:在DeepSeek Harness聊天框直接生图修图
dsh-image-gen是DeepSeek Harness的AI图像插件,支持对话生图、连续编辑、Studio批量创作、多模型对比、500+Prompt...
-
蚂蚁 inclusionAI 开源 6B 统一图像生成与编辑模型 LLaDA-Image
蚂蚁集团开源统一图像生成与编辑模型LLaDA-Image,含6B参数,提供Base和Turbo两版本,支持文生图、编辑及中英文渲染。Turbo采用蒸馏技术...
-
华为云码道Space重磅公测:AI驱动泛研发提效,开启全民开发创造新时代!
华为云推出码道Space,一款面向泛研发场景的一站式AI工作台,融合AI专家与技能,覆盖软件开发、设计、数据分析、办公等场景,支持文档处理、全栈编码、代码...
-
DeepSeek-V4 模型结构(1):序列维度(上),从 MLA 到压缩 KV
本文介绍DeepSeek-V4的注意力机制,从MHA到CSA/HCA的演进,重点分析压缩KV缓存的方法。V4将每4或128个token压缩为一条512维K...
-
DeepSeek-V4 模型结构(0):一张图看懂 DeepSeek-V4
本文介绍DeepSeek-V4模型架构:Pro版总参数1.6T、61层,Flash版284B、43层,均采用4条残差流、交错CSA/HCA压缩注意力与Mo...