小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
从“算力规模”到“产能效率”:Token工厂与模力方舟的AI产能落地逻辑

AI产业竞争正从算力规模转向产能效率,Token工厂将算力转化为可计量的Token产出。四川雅安“天绛·白泽Token工厂”已上线,目标月产能10万亿词元。Gitee AI(模力方舟)作为应用侧大模型平台,提供Serverless API、私有化部署与智算一体机,与Token工厂形成互补而非替代关系。

从“算力规模”到“产能效率”:Token工厂与模力方舟的AI产能落地逻辑

Gitee 官方博客 Gitee 官方博客 · 2026-09-10T11:32:59Z
Hermes和OpenClaw谁更强:自动记忆是效率神器还是思维牢笼

Hermes与OpenClaw两大AI智能体对比测试显示,Hermes能自动学习记忆但会固化用户偏好导致输出重复,适合学术研究;OpenClaw需手动配置但执行精确,适合执行任务。用户最终选择OpenClaw,因不愿被系统猜答案束缚。

Hermes和OpenClaw谁更强:自动记忆是效率神器还是思维牢笼

极道 极道 · 2026-09-09T22:31:00Z
构建多智能体系统:何时以及如何使用它们

多智能体系统是一种架构,多个大型语言模型(LLM)在独立对话中运行。本文重点介绍主代理-子代理模式,适合新团队。该系统在上下文污染、并行任务和工具选择等特定情况下优于单一代理,尽管增加了复杂性,但在合适场景下能提升效率和效果。

构建多智能体系统:何时以及如何使用它们

Claude Claude · 2026-09-09T14:27:33Z
DeepSeek V4.1 Flash吊打Vision Exp:少用43%token快38%

DeepSeek发布V4.1 Flash内测版,速度快38%、省43% token,但单价未变,单位时间消耗更多导致“烧钱更快”。该模型限时两天,旨在测试能否以Flash价格提供Pro能力。对比Vision Exp,新模型效率更高,但存在小缺陷。DeepSeek正加速迭代,布局从模型到Agent的完整生态。

DeepSeek V4.1 Flash吊打Vision Exp:少用43%token快38%

极道 极道 · 2026-09-08T22:25:00Z
GPT负责设计,离线27B负责执行:我超高效率但超省钱的工作流

文章介绍了一种高效且省钱的工作流:利用线上GPT进行全局规划与设计,再将方案交给离线模型(如Qwen 27B)执行具体任务。离线模型在后台运行,能自主解决环境问题,既保留线上模型能力,又大幅降低订阅成本,节省约90%费用。

GPT负责设计,离线27B负责执行:我超高效率但超省钱的工作流

Andy Stewart Andy Stewart · 2026-09-08T16:00:00Z
提升研发团队协作效率的工具选型指南:从协同平台到AI助手

本文介绍2026年研发团队协作工具选型:协同办公平台(飞书、钉钉、企业微信及私有化内网IM如BeeWorks)作为沟通底座;AI办公助手(豆包工作、WorkBuddy、千问办公)提升非编码效率;AI代码助手与远程控制工具补充开发场景。选型需结合团队规模、安全需求及工作流适配,持续优化。

提升研发团队协作效率的工具选型指南:从协同平台到AI助手

Gitee 官方博客 Gitee 官方博客 · 2026-09-07T11:56:31Z
压箱底办公神器:一键搞定Word、Excel、PDF、PPT、图片的批处理工具,效率翻倍!

鹰迅批量处理工具是一款无需登录的办公软件,支持Word、Excel、PDF、PPT、图片等格式,提供200种功能,如格式转换、批量修改、水印处理等,可离线批量处理数千文件,保障数据安全,旨在提升办公效率,告别繁琐手动操作。

压箱底办公神器:一键搞定Word、Excel、PDF、PPT、图片的批处理工具,效率翻倍!

小众软件 小众软件 · 2026-09-07T07:42:03Z
Kimi K3 模型结构(5):宽度维度,Stable LatentMoE

Kimi K3模型采用Stable LatentMoE作为FFN,基于NVIDIA LatentMoE改进,将输入压缩至半宽latent空间,增加RMSNorm稳定训练,用SiTU-GLU激活控制输出,并通过Quantile Balancing实现负载均衡。该模块占模型98%参数,每层激活16个专家,显著提升效率与性能。

Kimi K3 模型结构(5):宽度维度,Stable LatentMoE

Java不加糖's Blog Java不加糖's Blog · 2026-09-05T15:20:00Z
AI时代学编程:别背语法了,学逻辑才是正经事!

AI时代学编程,重点不在背语法,而在学逻辑。文章通过实例说明,编程思维能帮人精确表达需求,避免AI误解。核心是掌握循环、条件、调试等基础概念,用结构代替模糊愿望。这样与AI协作时,人负责思考“做什么”,AI负责“怎么写”,效率翻倍,沟通也更清晰。

AI时代学编程:别背语法了,学逻辑才是正经事!

极道 极道 · 2026-09-05T08:12:00Z
通过专用GPU内核生成实现极致效率

Proteus系统利用智能体自动生成GPU专用内核,针对不同模型和运行时形状实现极致性能优化。通过严格验证、防作弊检查及知识层管理,Proteus为Qwen 3.5 122B生成的内核比vLLM快1.8至5.2倍。核心挑战在于验证与上下文管理,而非生成本身,确保内核可靠且高效。

通过专用GPU内核生成实现极致效率

Databricks Databricks · 2026-09-04T20:00:00Z
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍

蚂蚁集团研发的统一宽表系统OmniTable获VLDB 2026工业赛道最佳论文。该系统管理超35PB、3050亿条大模型训练数据,通过逻辑统一、物理分离设计,将数据批次和特征列作为一等对象,简化数据定位、特征回刷和结果追溯。实际应用中,SFT数据准备周期从14天缩短至2.5天,手工步骤减少73.3%,显著提升数据工程效率。

还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍

量子位 量子位 · 2026-09-02T06:20:17Z
Token效率鄙视链被打脸:实测证明,Rust才是AI编程时代的隐藏赢家

Danluu通过Zstd解码器和Pandoc转换器两组真实工程评测,挑战了“动态语言更省Token”的观点。结果显示,在简单题目或低算力下动态语言占优,但高算力下静态语言反超。此前Rust表现差源于测试脚本符号链接Bug,修复后满分。C/C++代码存在内存安全问题,修复成本高。结论:无证据支持某语言天生适合AI编程,Rust被“平反”。

Token效率鄙视链被打脸:实测证明,Rust才是AI编程时代的隐藏赢家

Tony Bai Tony Bai · 2026-08-26T21:00:00Z
丰富智能背后的全栈技术

OpenAI发布首款自研推理芯片Jalapeño,在InferenceX基准测试中,其峰值吞吐量和延迟优于商业系统,并兼容多种模型。通过整合芯片、软件和硬件,OpenAI提升效率并降低成本,同时构建多元化供应商组合以优化性能与价格。效率提升带来更多使用需求,形成技术、经济与投资的良性循环,推动持续创新。

丰富智能背后的全栈技术

OpenAI OpenAI · 2026-08-25T07:05:00Z
Jalapeño首批成果展现AI推理领域领先的速度与效率

OpenAI自研推理芯片Jalapeño性能显著,每瓦特可处理更多AI任务,延迟更低,无需在吞吐与延迟间取舍。在GPT-OSS、DeepSeek R1及Kimi K2.5等模型上,其每瓦性能提升1.5至1.9倍,端到端延迟降低1.7至3.6倍。芯片设计优化数据移动,并借助AI加速开发与编程。计划年底部署,为多代平台首代。

Jalapeño首批成果展现AI推理领域领先的速度与效率

OpenAI OpenAI · 2026-08-25T07:00:00Z
每瓦特性能提升高达30倍:NVIDIA Vera Rubin NVL72为AI代理树立新效率标准

NVIDIA Vera Rubin NVL72在代理式AI工作负载中,每兆瓦吞吐量比GB300 NVL72高30倍,每百万token成本低35倍。该平台通过软硬件协同设计,支持分离式服务、专家并行、KV缓存等优化,提升推理效率,适合大规模AI工厂部署。

每瓦特性能提升高达30倍:NVIDIA Vera Rubin NVL72为AI代理树立新效率标准

NVIDIA Blog NVIDIA Blog · 2026-08-24T15:00:19Z
Codex 20 美元月费+Oh My Pi:token效率实测翻五倍!

20美元ChatGPT Plus搭配开源工具Oh My Pi,可将AI编程效率提升五倍。Oh My Pi通过哈希编辑、读取优化、压缩对话和顾问机制,大幅降低token消耗,解决官方工具的“上下文税”问题。但运行较慢、无图形界面,且大厂因商业利益不愿优化。

Codex 20 美元月费+Oh My Pi:token效率实测翻五倍!

极道 极道 · 2026-08-23T23:27:00Z
左移

编码代理已成为我的主要工具,我停止了手动编码。核心方法是“左移”:将大部分时间用于理解问题和制定清晰规格,而非实现。通过专用思考空间和工具(如Superpowers、Pi插件)强化规划,用代理测试验证结果。这提升了效率,避免了盲目执行带来的浪费。

左移

OnionTalk OnionTalk · 2026-08-21T10:00:00Z
国产“预制算力”来了:工厂预制率超90% 24小时内投运 交付效率提升70%

太初元碁发布分布式算力解决方案,以预制化集装箱算力单元为核心,推出风冷智算、液冷超节点及超节点集群三类产品,工厂预制率超90%,24小时投运,支持绿电接入和户外部署。方案配套算力管理平台,已在气象、生物医药等领域落地,并展示多款国产算力产品。

国产“预制算力”来了:工厂预制率超90% 24小时内投运 交付效率提升70%

量子位 量子位 · 2026-08-21T02:31:10Z
Huzzah伪代码编辑器:伪代码替代提示词编程

Huzzah是一款用伪代码替代自然语言提示词的AI编程工具,旨在解决开发者因反复输入长提示词导致的“AI疲劳症”。它通过持久化伪代码记录设计意图,仅将差异发送给LLM生成代码,提升效率。但争议在于其要求先设计后实现,可能不适合探索性工作,且跨文件依赖和规模问题待解。

Huzzah伪代码编辑器:伪代码替代提示词编程

极道 极道 · 2026-08-20T21:39:00Z
本地跑 AI Agent 成本到底有多低?

以懒猫AI算力舱(英伟达芯片,128GB显存)为例,通过Pi Agent运行DeepSeek V4 Flash,50分钟自动完成代码编写、Docker镜像构建及推送。两台设备运行时功耗约130W,一小时耗电0.13度,电费仅8分钱,日成本约1.9元。离线AI计算具备三大优势,适合处理软件工程体力活。

本地跑 AI Agent 成本到底有多低?

Andy Stewart Andy Stewart · 2026-08-20T16:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码