➡️
继续阅读
-
Minmax H3中英提示词效果差异测试 - 蝈蝈俊
作者测试了MiniMax H3视频生成模型,用中英文提示词生成同一首诗的视频,发现宏观效果差别不大,仅微观细节略有不同。原因是简单指令语义重叠,且随机性干...
-
GPT-6 突然全量上线,额度重置再+1,全网实测效果太离谱
OpenAI发布GPT-6 Astra,面向多类用户开放但额度受限。其核心能力是直接在Blender等软件中构建可交互3D世界,如河流、海洋场景,并能从图...
-
DeepSeek-V4 模型结构(0):一张图看懂 DeepSeek-V4
本文介绍DeepSeek-V4模型架构:Pro版总参数1.6T、61层,Flash版284B、43层,均采用4条残差流、交错CSA/HCA压缩注意力与Mo...
-
CD销量激增,实体媒体持续复兴
美国唱片业协会报告显示,2026年上半年CD销量达1750万张,同比增长45.7%,销售额增长58.6%至1.711亿美元,扭转了此前下滑趋势。黑胶唱片销...
-
Kimi K3 模型结构(7):结构决定系统
本文总结Kimi K3模型结构对训练与推理系统的影响。KDA采用三种执行形态(FlashKDA、设备内上下文并行、状态回滚)处理固定大小状态;上下文并行通...
-
Kimi K3 模型结构(6):输入端与零件,MoonViT-V2、MTP、Per-Head Muon
Kimi K3模型采用从零训练的MoonViT-V2视觉编码器,27层、patch14结构,支持高分辨率图像token化;MTP层预训练后微调为EAGLE...