小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
刷视频也能教会机器人干活!1200亿tokens人类动作预训练,误差按幂律下降

Figure、Dyna与亮源新创探索用人类视频预训练机器人。Figure的Index预训练将陌生家庭任务成功率从9%提升至56%,但未公开规模与闭环成功率的关系;Dyna验证人类视频规模扩大可持续提升真机表现;亮源新创用互联网视频验证迁移缩放定律。核心问题是人类经验能否成为可扩展的机器人预训练数据。

刷视频也能教会机器人干活!1200亿tokens人类动作预训练,误差按幂律下降

量子位 量子位 · 2026-09-23T04:25:12Z

Shopify's engineering introduced gisting, a novel technique for compressing long LLM prompts into a smaller set of learned "gist" tokens, improving throughput and reducing inference cost. By...

Shopify Introduces Gisting: Compressing LLM System Prompts into Learned Tokens

InfoQ InfoQ · 2026-09-03T20:00:00Z

本文介绍GeekAgent开发第七天,实现轻量TUI界面与用量面板。通过引入pi-tui库,程序接管终端,左侧显示消息流,右侧常驻面板展示模型、会话、上下文占用及本轮/累计tokens。接口回传usage数据,流式期间用字符估算。支持输入编辑、工具确认,退出恢复原终端。代码新增1115行,验证功能正常,为后续权限管理打基础。

从零实现 GeekAgent —— Day7 轻量 TUI 与用量面板

极客兔兔 极客兔兔 · 2026-08-26T13:30:00Z
华为云码道「码力续航计划」上线!

华为云CodeArts推出“码力续航计划”,每日免费发放1000万Tokens,用于复杂算法、项目解析和批量代码生成。用户登录即送,无需点击,额度每日刷新、次日重置,总量价值100万元,发完即止。活动旨在减轻开发者算力负担,提升编码效率。

华为云码道「码力续航计划」上线!

华为云官方博客 华为云官方博客 · 2026-08-20T02:21:03Z
Frugal Tokens:本地化 AI 会话成本与用量分析工具

Frugal Tokens是一款本地运行的AI会话成本分析工具,支持Claude Code、Cursor等助手,提供Token用量、费用拆解、缓存效率及跨模型价格对比。数据本地处理,隐私安全,基于Deno和SQLite,适合开发者优化AI编程开销。

Frugal Tokens:本地化 AI 会话成本与用量分析工具

极道 极道 · 2026-08-19T21:35:00Z

Baruch Sadogursky and Patrick Debois discuss why coding agents fail due to bloated context windows and stuffed prompts. They explain practical context engineering fixes, including lazy-loaded...

Presentation: The Right 300 Tokens Beat 100k Noisy Ones: The Architecture of Context Engineering

InfoQ InfoQ · 2026-08-14T11:00:00Z

Meryem Arik discusses strategies for designing low-cost LLM inference architectures for high-volume, non-real-time workloads. She explains how software architects and engineering leaders can...

Presentation: Producing the World's Cheapest Tokens: A How-to Guide

InfoQ InfoQ · 2026-08-11T10:05:00Z
每天几分钟,月省几百块Tokens钱

华为云推出开发者成长中心,用户通过每日签到、实名认证、开通码道、使用智能问答、发布文章、使用AI Shell、参加活动等低门槛任务赚取积分,可兑换代金券抵扣ECS、OBS等账单,实现免费运行轻量应用。连续打卡一个月可获400元代金券,并推荐开源项目实现任务自动化。

每天几分钟,月省几百块Tokens钱

华为云官方博客 华为云官方博客 · 2026-08-10T10:33:38Z
Tokens限时免费,华为云OfficeAce喊你早点下班!

华为云OfficeAce办公智能体0.4.5版上线,取消邀请码,内置大模型限时免费。新增AI Excel多表自动生成透视表、AI PPT风格复刻、AI Doc专利简报撰写、DeepResearch增强,支持多模态解析、AI生图入PPT、OCR扫描件识别,并优化PPT编辑和生成速度,提升办公效率。

Tokens限时免费,华为云OfficeAce喊你早点下班!

华为云官方博客 华为云官方博客 · 2026-07-21T07:22:45Z
数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

训练数据在大模型竞争中至关重要,NVIDIA推出的Nemotron系列数据集强调数据质量和任务适配性,涵盖通用文本预训练、监督微调和代码生成等核心能力,推动模型训练从数量向精准转变。这些数据集为大模型研究提供系统性支持,提升模型能力。

数据集汇总丨英伟达开源Nemotron系列数据集,超10T tokens+40M 条后训练样本,覆盖数学推理/代码生成/多语言对话

HyperAI超神经 HyperAI超神经 · 2026-07-17T08:06:36Z
超OpenCode四倍:Claude Code缓存重写成了tokens黑洞

在AI编程助手的使用中,Claude Code的隐性消费显著高于OpenCode。测试显示,Claude Code在执行简单任务前消耗了四倍的token,并且在对话中频繁重写缓存,导致额外费用。尽管功能强大,但两者在任务完成质量上无明显差异,用户需关注隐性成本,合理管理资源。

超OpenCode四倍:Claude Code缓存重写成了tokens黑洞

极道 极道 · 2026-07-12T22:01:00Z
GPT-5.6加速OpenAI内部研究100倍:tokens用量涨22倍

OpenAI的新模型GPT-5.6显著提升了科研效率,研究员的角色从操作工转变为指挥员。该模型能够自动诊断故障、优化系统、设计实验和解读数据,显示出AI在科研中的重要性。尽管流程加速,研究的创造性和判断力仍需人类掌握。

GPT-5.6加速OpenAI内部研究100倍:tokens用量涨22倍

极道 极道 · 2026-07-10T01:01:00Z
免费领 50 万 Tokens!EdgeOne Makers AI Agent 部署实测

EdgeOne Pages 升级为 EdgeOne Makers,新增 AI Agent 托管能力,支持快速部署 GitHub 上的 Agent 项目。开发者无需配置服务器即可获得可分享的 Demo 站点。当前活动中,填写邀请码可领取最高 50 万 Token 资源,便于快速验证和展示项目成果。

免费领 50 万 Tokens!EdgeOne Makers AI Agent 部署实测

如有乐享 如有乐享 · 2026-06-23T14:36:57Z
Claude Sonnet 4 现支持 100 万 tokens 的上下文

Claude Sonnet 4现支持高达100万tokens的上下文,适用于大规模代码分析和文档处理。该功能在Claude开发平台和Google Cloud的Vertex AI上进行公开测试,定价也进行了相应调整。

Claude Sonnet 4 现支持 100 万 tokens 的上下文

Claude Claude · 2026-06-21T22:13:52Z

Meta 正在限制员工的人工智能使用量,因最近 30 天内消耗高达 60 万亿 Tokens,预计将导致数十亿美元的支出。公司采取 Tokens 最小化策略,设定团队预算上限,并开发工具实时监控 AI 用量。其他科技公司如 Uber 和 Microsoft 也在实施类似措施以控制成本。

30天消耗60万亿Tokens!Meta发布备忘录宣布限制员工的AI用量以控制成本

蓝点网 蓝点网 · 2026-06-13T05:22:45Z
实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

小米推出了MiMo-V2.5-Pro-UltraSpeed模型,具备1T参数和1000+ TPS的推理速度,突破了GPU的性能限制。该模型在全栈开发任务中表现优异,能够快速生成高质量的复杂应用,推动了大模型的商业化进程。

实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

量子位 量子位 · 2026-06-11T01:18:16Z
苹果Siri AI系统提示词已经泄露 超过1,300行指令 提示词本身就有9,000 Tokens

苹果在WWDC 2026上推出了新的Siri AI,系统提示词长达1300行,包含9000个Token。提示词强调诚实原则,要求Siri在无法完成任务时明确告知用户,并在回答前进行思考,以提高准确性。Siri AI被定义为无情感的软件,具备结构化处理信息和智能响应的能力。

苹果Siri AI系统提示词已经泄露 超过1,300行指令 提示词本身就有9,000 Tokens

蓝点网 蓝点网 · 2026-06-10T02:30:29Z
5亿Tokens白送!全球首个商用AI主机发布,终于能放开烧Token了

联想推出的百应AI主机旨在解决个人公司在AI应用中的Token费用和安全问题,提供本地与云端结合的智能解决方案,降低Token成本,推动AI技术的普及与应用。

5亿Tokens白送!全球首个商用AI主机发布,终于能放开烧Token了

量子位 量子位 · 2026-05-29T09:05:30Z
在24GB M4 MacBook上跑本地大模型:Qwen 3.5-9B实测40 tokens/s,支持工具调用

开发者jola分享了在M4 MacBook Pro上运行Qwen 3.5-9B(Q4_K_S量化版)本地大语言模型的经验,尽管该模型无法完成复杂任务,但它提升了开发者的参与度,成为一种可控的离线助手,适合24GB内存的用户。

在24GB M4 MacBook上跑本地大模型:Qwen 3.5-9B实测40 tokens/s,支持工具调用

dotNET跨平台 dotNET跨平台 · 2026-05-12T00:01:01Z
上下文窗口被打破:Subquadratic推出1200万tokens的窗口

Subquadratic公司推出了一种新模型,支持高达1200万tokens的上下文窗口,声称在检索效率上超越现有模型。其选择性注意力架构在计算和内存上实现线性扩展,速度比传统模型快52倍。公司计划未来推出5000万tokens的模型,并提供API和编码工具。尽管面临挑战,Subquadratic在多个基准测试中表现优异,吸引了投资者关注。

上下文窗口被打破:Subquadratic推出1200万tokens的窗口

The New Stack The New Stack · 2026-05-05T18:01:04Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码