小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI

过去一周的AI圈,用“变天”来形容一点不夸张。7月24日,Anthropic发布Claude Opus 5,在ARC-AGI-3推理测试上拿到30.2%——是GPT-5.6 Sol的近4倍。三天后,月之暗面把Kimi...

2.8万亿参数免费送:AI圈的“斯普特尼克时刻”来了

王佳冬中文博客
王佳冬中文博客 · 2026-07-29T02:39:09Z
Kimi K3缓存为何比DeepSeek V4大,2.78万亿参数与24层无压缩层的真相

金句:两万亿参数模型打架,偷看小抄那个真能赢吗? Moonshot的K3缓存比DeepSeek V4大,这件事本身就像学霸考试带了两本笔记本。一本记重点,一本记全部。但重点来了,两本笔记本的重量差距,直接决定了谁跑得快、谁记得牢。这篇文章不聊代码,只聊缓存大小背后那点人性。缓存就是模型的小抄本,越大能记的东西越多,但翻书速度也越慢。...

Kimi K3缓存为何比DeepSeek V4大,2.78万亿参数与24层无压缩层的真相

极道
极道 · 2026-07-28T10:26:00Z
在线教程|不用百亿参数也能跑Agent!Boss直聘南北阁实验室开源Nanbeige4.2-3B,让小模型拥有「大脑」

Nanbeige4.2-3B:紧凑型智能体模型」已在 HyperAI(hyper.ai)上线,帮助开发者以更低成本探索本地智能体应用,感兴趣的小伙伴快来一键探索吧!1、进入 hyper.ai 首页后,选择「教程」页面,或点击「查看更多教程」,选择「Nanbeige4.2-3B:紧凑型智能体模型」,点击「运行此教程」。2.待运行完成,根据 README 提示,在终端输入代码启动 Open...

在线教程|不用百亿参数也能跑Agent!Boss直聘南北阁实验室开源Nanbeige4.2-3B,让小模型拥有「大脑」

HyperAI超神经
HyperAI超神经 · 2026-07-28T09:57:05Z
从GPT2到Kimi七年22580倍:Kimi k3怎么塞下2.8T参数?

一台手机能塞下两万台电脑,那电脑会哭吗? GPT-2在2019年还是个大家伙,1.24亿个参数。到了2026年,Kimi K3塞进了2.8万亿个参数。两者一比,差了22580倍。七年时间,数字翻了这么多,中间到底发生了什么?不是简单地把模型做大。每一代架构都在解决同一个头疼的问题:记忆体塞满了怎么办。...

从GPT2到Kimi七年22580倍:Kimi k3怎么塞下2.8T参数?

极道
极道 · 2026-07-28T01:03:00Z
2.8万亿参数Kimi K3正式开源:全球AI产业格局生变

【TechWeb】7月28日消息,月之暗面27日深夜正式发布Kimi K3模型权重、技术报告,并同步开源三项关键基础设施技术。这是Kimi迄今能力最强的模型,也是中国AI开源社区迄今为止规模最大的一次技术开放。月之暗面在公告中表示,坚信开放权重模型的价值,它们能降低获取智能的门槛,推动创新,并赋予用户对数据更大的控制权、隐私保护和所有权。根据Kimi...

2.8万亿参数Kimi K3正式开源:全球AI产业格局生变

TechWeb 全站精华
TechWeb 全站精华 · 2026-07-28T00:58:45Z
80张游戏卡跑2.8T参数Kimi k3:不用HBM芯片,普通网线就搞定

80张显卡跑Kimi k3本地大模型!Kimi K3这个庞然大物有2.8万亿个参数,居然只用游戏显卡和普通网线就跑了起来:80张RTX 5090联手干活,每秒吐20个词。 这等于把超级计算机的门槛踹碎了,任何实验室、初创公司甚至大学都能上手把玩。 开放权重模型第一次摆脱了昂贵的HBM芯片的绑架,只用GDDR7显存和MXFP4压缩格式就实现了前沿智能。 参数巨人闯进游戏厅 2.8万

80张游戏卡跑2.8T参数Kimi k3:不用HBM芯片,普通网线就搞定

极道
极道 · 2026-07-28T00:53:00Z
超越π0,中国团队用1B参数模型登顶具身智能榜单

具身智能正在从「参数竞赛」进入「架构竞赛」。

超越π0,中国团队用1B参数模型登顶具身智能榜单

量子位
量子位 · 2026-07-23T06:36:08Z
一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

AI模型价格从70万打到1.5万,开源社区是把大厂当韭菜割了吗? 80%的模型体积被削掉,智商居然还保留82%。一群民间高手在Discord里把7530亿参数的顶级大模型塞进了不到2万块的显卡里,他们到底对模型干了什么? 模型体积与内存带宽构成第一道成本高墙...

一万五刀跑通7530亿参数GLM-5.2:开源模型量化压缩技术全解析

极道
极道 · 2026-07-22T22:13:00Z
移动端视频编码参数速查:Claude Code Skill 一键查询最佳配置

编码参数选错,轻则画质下降,重则用户投诉「视频模糊」。但 iOS VideoToolbox 和 Android MediaCodec 的参数体系完全不同。本文写一个 Claude ...

移动端视频编码参数速查:Claude Code Skill 一键查询最佳配置

实时互动网
实时互动网 · 2026-07-20T02:52:52Z
397B参数追平万亿模型,上海AI Lab发布科学智能体新基座 | WAIC 2026

上海人工智能实验室发布了基于新架构的Intern-S2-Preview-397B大模型,旨在解决科学智能领域的知识与推理分离问题。该模型通过Memory Decoder和Mobius架构实现专业知识的动态更新与推理效率提升,显著提高了生命科学和材料科学等领域的科研效率和准确性。

397B参数追平万亿模型,上海AI Lab发布科学智能体新基座 | WAIC 2026

量子位
量子位 · 2026-07-17T09:20:14Z
AI华语歌,终于能听了!从零预训练十亿参数,告别「人机味」

歌歌AI开发了一种新型AI音乐模型,专注于生成符合中文演唱逻辑的音乐,解决了中文歌词与旋律的对齐问题,提升了人声的自然度和情感表达。与字节跳动合作,确保生成的音乐合法上架多个平台,推动AI音乐的商业化。此外,计划研发民乐专属模型,以保护和传承传统文化。

AI华语歌,终于能听了!从零预训练十亿参数,告别「人机味」

量子位
量子位 · 2026-07-10T04:44:38Z
“Opus级,但更快”:埃隆·马斯克谈如何超越Anthropic

埃隆·马斯克宣布,SpaceXAI将于周四发布Grok 4.5模型,该模型在内部测试中获得积极反馈。Grok 4.5是一个更快、更高效、成本更低的Opus级模型,基于1.5万亿参数的V9基础模型,并经过Cursor的专门训练,可能在软件工程任务中表现更佳。此外,预计在八月发布更大规模的2万亿参数V系列模型。

“Opus级,但更快”:埃隆·马斯克谈如何超越Anthropic

The New Stack
The New Stack · 2026-07-08T18:59:49Z
在 llama-server 中的采样参数

本文讨论了通过调整 llama.cpp 的采样参数(如温度、TopP、MinP、TopK)来提高模型推理速度和效果,减少重复、幻觉和语法降解。强调现代采样方法(如 DRY、XTC 和 Mirostat)的优势,合理配置可显著提升本地模型的生成质量和效率。

在 llama-server 中的采样参数

Alex Ewerlöf Notes
Alex Ewerlöf Notes · 2026-07-01T18:28:35Z
国产芯片上跑出的万亿参数模型,美团 LongCat-2.0 正式发布

美团发布了新一代万亿参数大模型LongCat-2.0,并将其开源。该模型在国产算力集群上完成全流程训练,支持1M超长上下文,专注于代码理解与生成,表现优异,成为全球开发者的热门选择。

国产芯片上跑出的万亿参数模型,美团 LongCat-2.0 正式发布

实时互动网
实时互动网 · 2026-06-30T02:51:59Z
WAIC UP!|AI圈都在聊参数,我们偏不

文章讨论了AI领域的参数话题,并提到在即将举行的WAIC UP!活动中,行业对这一主题的关注。此外,文章还提到与三体宇宙合作发布的AI全感穿戴设备。

WAIC UP!|AI圈都在聊参数,我们偏不

mongona news
mongona news · 2026-06-25T09:59:40Z
WAIC UP!|AI圈都在聊参数,我们偏不

AI行业正在快速变化,WAIC UP!选择深入思考而非追逐热点,通过刊物和线下活动汇聚全球思想领袖,探讨技术对人类的意义。到2026年,WAIC UP!将进一步推动青年参与和实践,成为思辨的前沿阵地。

WAIC UP!|AI圈都在聊参数,我们偏不

量子位
量子位 · 2026-06-25T09:59:40Z
微调6亿参数Qwen3 4B实现91.6%分类准确率

通过微调6亿参数的小模型Qwen 3 0.6B,家庭问题分类准确率从9.92%提升至91.6%。关键在于让模型学习无意义的代码,降低认知负担,提升分类效果。这一策略适用于特定领域的AI应用。

微调6亿参数Qwen3 4B实现91.6%分类准确率

极道
极道 · 2026-06-22T02:47:00Z
全员本科生!何恺明组新作:文生图,258M参数就够了

何恺明团队推出新论文MiniT2I,探索文生图生成。该模型基于MM-JiT架构,仅用258M参数,训练成本相当于一次标准ImageNet实验。MiniT2I通过直接在像素空间生成图像,简化了模型结构,去掉了VAE等复杂模块,显著降低计算开销。实验结果显示,MiniT2I在性能上超过多款大型模型,展现出强大竞争力。

全员本科生!何恺明组新作:文生图,258M参数就够了

量子位
量子位 · 2026-06-18T09:12:09Z
NVIDIA 发布 Nemotron 3.5 ASR:一个拥有 6 亿参数、支持缓存的流式转录模型,可实时转录 40 种语言区域设置

NVIDIA发布了Nemotron 3.5 ASR,这是一个支持40种语言的流式自动语音识别模型,拥有6亿参数。该模型采用FastConformer-RNNT架构,实时转录时无需单独处理标点和大小写,推理延迟可调,适合多种应用场景。经过微调,希腊语和保加利亚语的识别准确率显著提高。

NVIDIA 发布 Nemotron 3.5 ASR:一个拥有 6 亿参数、支持缓存的流式转录模型,可实时转录 40 种语言区域设置

实时互动网
实时互动网 · 2026-06-08T02:31:38Z

jiascheduler 是一个用 Rust 编写的高性能开源任务调度系统,支持海量节点管理和多种任务类型。v2.0.0 版本新增工作流支持,允许定时执行和图形化界面编辑,具备用户权限管理和团队协作等企业级功能,适用于运维自动化和混合云管理。项目免费开源,社区活跃。

jiascheduler 作业调度平台 v2.0.0 发布,支持 workflow 和作业作业参数

Rust.cc
Rust.cc · 2026-06-01T01:24:47Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码