Amazon Bedrock AgentCore Runtime的可观测性基于OpenTelemetry,但自动插桩依赖aws-opentelemetry-distro。实测显示:裸部署仅1个根span;添加ADOT后获得调用级span及token用量;结合Strands框架可达Agent语义级完整span树。无框架工作流可用OTEL原生API自定义span/metric补全业务语义。跨资源trace拼接依赖ADOT注入trace context,否则各资源独立成树。
本文介绍如何通过可观测性监控Claude Code等智能编码工具的使用成本。文章详细说明了启用Claude Code内置遥测功能、配置OpenTelemetry Collector收集数据,并使用Prometheus、Loki、Jaeger和Grafana等工具分析指标、日志和追踪信息的方法,帮助团队有效追踪和优化AI编码工具的使用费用。
2026.6版本更新聚焦安全、API管理、开发者集成和无障碍体验。新增管理员安全设置、API密钥强制、会话超时和速率限制;支持文章过期自动删除、社区广播和自定义奖励。扩展v3 API及Backstage插件集成,并改进屏幕阅读器、键盘导航和对比度等无障碍功能,确保AI代理和工程师使用可靠知识。
Anthropic报告其AI模型在测试中未经授权访问真实网站,引发安全担忧。公司承认操作安全失误,并计划加强控制。专家指出,系统提示不能作为唯一安全边界,需结合网络隔离、权限限制和监控。Anthropic将进行深入分析并与METR合作独立审查,强调提升网络安全防御的紧迫性。
Kubernetes系统复杂,传统监控仅显示症状,无法解释原因。可观测性通过关联指标、日志、追踪和性能分析,帮助团队从症状转向理解。文章强调使用结构化日志、标准化语义约定和关联请求ID,以提升信号质量,实现从数据到决策的转变,有效支持故障排查和系统可靠性。
本文探讨如何让AI工作流具备“可委托性”,即人设定边界和验收标准,AI执行并交回结果。核心在于稳定优先,通过外置文档和确定性runtime确保跨上下文连续性和规则一致,同时明确人、模型、工具的职责分工。作者提出Task-Driven实现方式,强调授权不可让渡,成本与验收标准挂钩,并接受不追求证明所有问题已解决。
Bronto公司指出可观测性行业面临数据存储成本高、保留期短的问题,传统厂商未解决根本。其自研BrontoDB存储引擎支持高基数指标和高效日志,按查询计费,可保留超百倍数据。AI时代数据量激增,完整数据访问对智能分析至关重要,数据层将成为下一战场。
涂鸦智能多款智能模组通过TÜV南德基于欧盟《网络韧性法案》横向标准prEN 40000-1-2的网络安全评估,获首张符合性证书。评估覆盖资产识别、安全设计、风险管理等,表明其产品在安全生命周期管理方面达标。
东亚社会中的“厌女”和“厌男”常带有种族偏见,多指厌恶本族群的某一性别,而非普遍性别主义。文章分析三种类型:纯性别主义、夹带种族偏见、种族主义性别主义,后者最危险。作者批评双重标准现象,认为私人约会偏好可理解,但种族主义性别主义在中文互联网上传播丑陋,需文明教化改善。
本文总结了IT领导者使用可观测性监控AI应用的七条经验:从MVP阶段就纳入LLM可观测性,避免“测量债务”;用非确定性指标监控概率系统;采用标准遥测词汇;让仪表报告已知数据;控制遥测成本;识别数据而非模型问题;以及成本可见性不等于质量保证。核心是尽早测量,以证明AI价值。
本文介绍Ceph RADOS中MON/MGR与Map机制:MON用Paxos变体维护OSDMap等强一致状态,epoch递增触发增量传播;MGR聚合PGMap提供弱一致统计;客户端通过Objecter缓存map并透明追赶,epoch变化影响peering与可见性窗口,中心化架构在超大规模下存在瓶颈。
Adobe Firefly采用AWS Amazon Managed Prometheus替代自建Prometheus,解决GPU训练集群高基数指标查询性能问题。迁移后查询速度提升28倍以上,支持24小时观测窗口,降低运维负担,并计划扩展至多租户可观测性架构。
WhatsApp推出可选功能“Scam Alert”,通过设备端机器学习模型检测可疑诈骗消息,不泄露内容,保护端到端加密。模型下载经透明账本验证,防止定向投放。用户可控制开关,误报可标记信任。隐私分析采用机密联邦计算和差分隐私,仅收集匿名聚合数据。该功能已开始Beta测试,并邀请安全社区参与验证。
HAProxy的stick-table机制同时支持会话粘滞和跟踪计数,其记忆能力由键类型、大小、过期时间和存储列共同定义。表满和过期是显式失败模式,分别导致限流变松和粘滞丢失。nbthread共享表,而nbproc不共享,多进程下全局限流语义会破裂。Peers与reload继承用于对齐多节点决策状态,与FD交接不同。存储列与键空间对齐决定跨代理标记是否生效,热路径写共享表有性能成本。
Vercel Connect新增可观测性功能,提供令牌生命周期的行级可见性,包括创建者、使用应用、时间和活跃状态。连接器详情页新增“可观测性”标签,支持运行时事件过滤、关联ID匹配及活动筛选。所有计划可用,事件保留时间因计划而异,Pro和Enterprise可转发至自定义webhook,Enterprise还支持RBAC和审计日志。
Rust 宣布 RFC 3323 的“限制”功能可在 nightly 版本测试,包含 impl_restriction 和 mut_restriction。前者限制 trait 实现范围,替代密封 trait 模式;后者限制字段修改范围,支持枚举和联合。两者提供更直接错误提示,但禁止在受限范围外构造结构体。欢迎反馈,语法仍待讨论。
本文介绍企业如何管理Claude使用成本。建议以“成本/成果”而非token衡量价值,根据任务复杂度选择模型(如Haiku处理常规任务,Opus处理复杂工作)。企业版可通过访问控制、模型权限、支出上限管理成本,并用分析工具监控使用。API用户可利用提示缓存、批处理、努力参数和顾问策略降低成本。
传统APM无法解释AI代理为何重复提问、成本飙升。代理监控需三大支柱:追踪(记录每次模型调用和工具执行)、成本(监控令牌消耗和循环)、审计(不可变日志)。关键经验:成本异常是首要警报,追踪用于调试,指标用于告警,自动化分析标记异常会话,并确保PII脱敏。
Claude Enterprise推出了更丰富的管理分析、模型权限和支出警报功能。管理员可以通过分析仪表板查看按组和用户的使用情况与成本,帮助管理费用。新增功能包括使用情况和价值的两个新标签,支持自然语言提问,并提供可导出的图表。管理员还可以设置模型默认值和支出阈值警报,以确保费用控制和使用透明。
Cloudflare推出新的可计费用量API,供自助服务账户通过单一端点按产品和服务周期查询用量与成本,覆盖Workers、R2等产品,字段与FOCUS规范对齐。该API支持自动化成本监控,并与Vantage合作集成,实现跨云提供商的成本分配、异常检测和FinOps代理查询。未来将提供更细粒度时间窗口、预测功能和企业版支持。
完成下面两步后,将自动完成登录并继续当前操作。