小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
华为云码道「码力续航计划」上线!

华为云CodeArts推出“码力续航计划”,每日免费发放1000万Tokens,用于复杂算法、项目解析和批量代码生成。用户登录即送,无需点击,额度每日刷新、次日重置,总量价值100万元,发完即止。活动旨在减轻开发者算力负担,提升编码效率。

华为云码道「码力续航计划」上线!

华为云官方博客 华为云官方博客 · 2026-08-20T02:21:03Z
Frugal Tokens:本地化 AI 会话成本与用量分析工具

Frugal Tokens是一款本地运行的AI会话成本分析工具,支持Claude Code、Cursor等助手,提供Token用量、费用拆解、缓存效率及跨模型价格对比。数据本地处理,隐私安全,基于Deno和SQLite,适合开发者优化AI编程开销。

Frugal Tokens:本地化 AI 会话成本与用量分析工具

极道 极道 · 2026-08-19T21:35:00Z

Baruch Sadogursky and Patrick Debois discuss why coding agents fail due to bloated context windows and stuffed prompts. They explain practical context engineering fixes, including lazy-loaded...

Presentation: The Right 300 Tokens Beat 100k Noisy Ones: The Architecture of Context Engineering

InfoQ InfoQ · 2026-08-14T11:00:00Z

Meryem Arik discusses strategies for designing low-cost LLM inference architectures for high-volume, non-real-time workloads. She explains how software architects and engineering leaders can...

Presentation: Producing the World's Cheapest Tokens: A How-to Guide

InfoQ InfoQ · 2026-08-11T10:05:00Z
每天几分钟,月省几百块Tokens钱

华为云推出开发者成长中心,用户通过每日签到、实名认证、开通码道、使用智能问答、发布文章、使用AI Shell、参加活动等低门槛任务赚取积分,可兑换代金券抵扣ECS、OBS等账单,实现免费运行轻量应用。连续打卡一个月可获400元代金券,并推荐开源项目实现任务自动化。

每天几分钟,月省几百块Tokens钱

华为云官方博客 华为云官方博客 · 2026-08-10T10:33:38Z
Tokens限时免费,华为云OfficeAce喊你早点下班!

华为云OfficeAce办公智能体0.4.5版上线,取消邀请码,内置大模型限时免费。新增AI Excel多表自动生成透视表、AI PPT风格复刻、AI Doc专利简报撰写、DeepResearch增强,支持多模态解析、AI生图入PPT、OCR扫描件识别,并优化PPT编辑和生成速度,提升办公效率。

Tokens限时免费,华为云OfficeAce喊你早点下班!

华为云官方博客 华为云官方博客 · 2026-07-21T07:22:45Z
数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

训练数据在大模型竞争中至关重要,NVIDIA推出的Nemotron系列数据集强调数据质量和任务适配性,涵盖通用文本预训练、监督微调和代码生成等核心能力,推动模型训练从数量向精准转变。这些数据集为大模型研究提供系统性支持,提升模型能力。

数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

HyperAI超神经 HyperAI超神经 · 2026-07-17T08:06:36Z
超OpenCode四倍:Claude Code缓存重写成了tokens黑洞

在AI编程助手的使用中,Claude Code的隐性消费显著高于OpenCode。测试显示,Claude Code在执行简单任务前消耗了四倍的token,并且在对话中频繁重写缓存,导致额外费用。尽管功能强大,但两者在任务完成质量上无明显差异,用户需关注隐性成本,合理管理资源。

超OpenCode四倍:Claude Code缓存重写成了tokens黑洞

极道 极道 · 2026-07-12T22:01:00Z
GPT-5.6加速OpenAI内部研究100倍:tokens用量涨22倍

OpenAI的新模型GPT-5.6显著提升了科研效率,研究员的角色从操作工转变为指挥员。该模型能够自动诊断故障、优化系统、设计实验和解读数据,显示出AI在科研中的重要性。尽管流程加速,研究的创造性和判断力仍需人类掌握。

GPT-5.6加速OpenAI内部研究100倍:tokens用量涨22倍

极道 极道 · 2026-07-10T01:01:00Z
免费领 50 万 Tokens!EdgeOne Makers AI Agent 部署实测

EdgeOne Pages 升级为 EdgeOne Makers,新增 AI Agent 托管能力,支持快速部署 GitHub 上的 Agent 项目。开发者无需配置服务器即可获得可分享的 Demo 站点。当前活动中,填写邀请码可领取最高 50 万 Token 资源,便于快速验证和展示项目成果。

免费领 50 万 Tokens!EdgeOne Makers AI Agent 部署实测

如有乐享 如有乐享 · 2026-06-23T14:36:57Z

Meta 正在限制员工的人工智能使用量,因最近 30 天内消耗高达 60 万亿 Tokens,预计将导致数十亿美元的支出。公司采取 Tokens 最小化策略,设定团队预算上限,并开发工具实时监控 AI 用量。其他科技公司如 Uber 和 Microsoft 也在实施类似措施以控制成本。

30天消耗60万亿Tokens!Meta发布备忘录宣布限制员工的AI用量以控制成本

蓝点网 蓝点网 · 2026-06-13T05:22:45Z
实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

小米推出了MiMo-V2.5-Pro-UltraSpeed模型,具备1T参数和1000+ TPS的推理速度,突破了GPU的性能限制。该模型在全栈开发任务中表现优异,能够快速生成高质量的复杂应用,推动了大模型的商业化进程。

实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

量子位 量子位 · 2026-06-11T01:18:16Z
苹果Siri AI系统提示词已经泄露 超过1,300行指令 提示词本身就有9,000 Tokens

苹果在WWDC 2026上推出了新的Siri AI,系统提示词长达1300行,包含9000个Token。提示词强调诚实原则,要求Siri在无法完成任务时明确告知用户,并在回答前进行思考,以提高准确性。Siri AI被定义为无情感的软件,具备结构化处理信息和智能响应的能力。

苹果Siri AI系统提示词已经泄露 超过1,300行指令 提示词本身就有9,000 Tokens

蓝点网 蓝点网 · 2026-06-10T02:30:29Z
5亿Tokens白送!全球首个商用AI主机发布,终于能放开烧Token了

联想推出的百应AI主机旨在解决个人公司在AI应用中的Token费用和安全问题,提供本地与云端结合的智能解决方案,降低Token成本,推动AI技术的普及与应用。

5亿Tokens白送!全球首个商用AI主机发布,终于能放开烧Token了

量子位 量子位 · 2026-05-29T09:05:30Z
在24GB M4 MacBook上跑本地大模型:Qwen 3.5-9B实测40 tokens/s,支持工具调用

开发者jola分享了在M4 MacBook Pro上运行Qwen 3.5-9B(Q4_K_S量化版)本地大语言模型的经验,尽管该模型无法完成复杂任务,但它提升了开发者的参与度,成为一种可控的离线助手,适合24GB内存的用户。

在24GB M4 MacBook上跑本地大模型:Qwen 3.5-9B实测40 tokens/s,支持工具调用

dotNET跨平台 dotNET跨平台 · 2026-05-12T00:01:01Z
上下文窗口被打破:Subquadratic推出1200万tokens的窗口

Subquadratic公司推出了一种新模型,支持高达1200万tokens的上下文窗口,声称在检索效率上超越现有模型。其选择性注意力架构在计算和内存上实现线性扩展,速度比传统模型快52倍。公司计划未来推出5000万tokens的模型,并提供API和编码工具。尽管面临挑战,Subquadratic在多个基准测试中表现优异,吸引了投资者关注。

上下文窗口被打破:Subquadratic推出1200万tokens的窗口

The New Stack The New Stack · 2026-05-05T18:01:04Z

GitHub Copilot将于2026年6月1日起实施按量计费模式,因应对不断上涨的成本。每个订阅套餐将获得相应的AI信用点,使用量按tokens计算。开发者可提前了解费用并选择购买额外信用点。不同订阅的信用点和费用已公布,企业用户可共享未使用的信用点。

Copilot从6月1日开始转为按量计费 根本原因是GitHub难以承受不断飙涨的成本

蓝点网 蓝点网 · 2026-04-28T03:38:15Z
ICLR 2026 丨单任务可训练参数减少 125 倍!新方法 Task Tokens 助力具身智能提升复杂任务能力

以色列理工学院的研究团队提出了一种名为 Task Tokens 的方法,旨在高效适配行为基础模型(BFM)到特定任务。该方法通过减少可训练参数和提高收敛速度,保持了模型的灵活性和泛化能力。实验表明,Task Tokens 在多种任务中表现优异,尤其在应对环境变化时展现出更强的鲁棒性。

ICLR 2026 丨单任务可训练参数减少 125 倍!新方法 Task Tokens 助力具身智能提升复杂任务能力

HyperAI超神经 HyperAI超神经 · 2026-04-23T05:28:20Z

人工智能Claude Opus 4.6和Claude Code近期性能显著下降,用户和开发者对此表示不满。开发者指出模型在复杂任务中的表现不佳,指令遵循能力下降,错误率上升。Anthropic承认调整了模型的努力程度以减少算力消耗,导致用户配额消耗加快,部分开发者质疑此举是为降低成本以准备上市,若不解决算力问题,可能会失去用户。

微软和AMD研究员都在吐槽Claude Code质量下降 疑似是为了节省tokens

蓝点网 蓝点网 · 2026-04-15T09:41:08Z

阿里云宣布自2026年4月13日起停止Coding Plan Lite版的续费和升级,现有订阅到期后结束。这一调整反映了整体涨价趋势,开发者将面临更高的Tokens购买成本。其他云服务商也在缩减基础订阅权益,未来AI模型使用费用将持续增加。

阿里云Coding Plan Lite套餐停止续费和升级 后续将被下架

蓝点网 蓝点网 · 2026-04-13T01:40:40Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码