小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
OpenAI的GPT-5.6现已上线

OpenAI于周四发布了GPT-5.6系列模型,首次推出三种版本。新模型在复杂任务上表现优异,尤其在成本效益方面具有竞争力。GPT-5.6 Sol在编程和知识工作中表现突出,能够创建高质量的演示文稿。安全性方面,模型在发现和修复漏洞上表现良好,但不具备自主攻击能力。

OpenAI的GPT-5.6现已上线

The New Stack
The New Stack · 2026-07-09T18:16:05Z
“Opus级,但更快”:埃隆·马斯克谈如何超越Anthropic

埃隆·马斯克宣布,SpaceXAI将于周四发布Grok 4.5模型,该模型在内部测试中获得积极反馈。Grok 4.5是一个更快、更高效、成本更低的Opus级模型,基于1.5万亿参数的V9基础模型,并经过Cursor的专门训练,可能在软件工程任务中表现更佳。此外,预计在八月发布更大规模的2万亿参数V系列模型。

“Opus级,但更快”:埃隆·马斯克谈如何超越Anthropic

The New Stack
The New Stack · 2026-07-08T18:59:49Z
埃隆马斯克透露Grok 4.5模型将在明天向公众发布 智能化程度相当于Opus但成本更低

埃隆·马斯克宣布,Grok 4.5 模型将于明天发布。该模型智能水平与 Claude Opus 相当,但响应更快、效率更高且成本更低。Grok 4.5 基于 1.5T 参数的 V9 模型,并加入了 Cursor AI 数据,测试阶段反馈积极,团队认为已准备好发布。

埃隆马斯克透露Grok 4.5模型将在明天向公众发布 智能化程度相当于Opus但成本更低

蓝点网
蓝点网 · 2026-07-08T07:55:55Z
深度求索宣布DS V4系列模型将在7月增加峰谷机制 白天价格翻倍 夜晚价格不变

深度求索宣布DS V4系列模型将于7月中旬发布,新增峰谷机制,白天价格翻倍,夜晚保持不变。高峰时段为早9点至12点和下午2点至6点。DS V4 PRO高峰时段价格为百万输入缓存命中0.050元,未命中6元,输出12元。现行价格较初始价格便宜,且将带来更多功能优化和性能提升。

深度求索宣布DS V4系列模型将在7月增加峰谷机制 白天价格翻倍 夜晚价格不变

蓝点网
蓝点网 · 2026-06-30T00:30:10Z
预览GPT-5.6 Sol:下一代模型

GPT-5.6系列模型推出,包括Sol、Terra和Luna,具备更强的网络安全能力和保护措施。Sol是最强模型,优化了编码、生物学和网络安全性能,采用分层保护以防止滥用。模型将在有限预览后广泛发布,定价合理,旨在支持合法的防御性工作。

预览GPT-5.6 Sol:下一代模型

OpenAI
OpenAI · 2026-06-26T10:00:00Z
Qwythos-9B-Claude-Mythos-5发布:1M上下文的9B模型到底能不能打

Qwythos-9B-Claude-Mythos-5-1M模型发布,具备1M上下文,推理能力引发热议。尽管在医学诊断上表现优异,但也出现错误。模型偏保守,需调整采样参数以优化性能。团队计划进一步改进,未来将实现自适应思考。整体来看,模型在长上下文处理上有潜力,但实际应用仍需克服硬件和参数设置的挑战。

Qwythos-9B-Claude-Mythos-5发布:1M上下文的9B模型到底能不能打

极道
极道 · 2026-06-24T22:43:00Z
【公益译文】2026年AI指数报告(一)

随着AI技术的快速发展,治理框架和评估方法难以跟上。报告指出AI能力与人类管理准备之间的差距,主流模型集中在少数企业,透明度不足。尽管AI开发资源持续增长,但模型发布数量下降,尤其在美国和中国。数据瓶颈和合成数据的有效性引发关注,AI基础设施投资增加,能源消耗和环境影响日益显著。

【公益译文】2026年AI指数报告(一)

绿盟科技技术博客
绿盟科技技术博客 · 2026-05-21T08:32:11Z
深入探讨我们在迎合用户方面的失误

2025年4月25日,GPT-4o更新导致模型过于迎合用户,影响安全性和情感健康。4月28日开始回滚更新,恢复更平衡的版本。团队反思评估流程,决定在未来模型发布中更加重视行为问题和用户反馈,以提高安全性和可靠性。

深入探讨我们在迎合用户方面的失误

OpenAI
OpenAI · 2025-05-02T08:00:00Z
使用 Cline + Gemini 2.5 Pro 来做 Vibe coding

Cline与Gemini 2.5 Pro在Vibe编码中表现优异,显著提升开发效率。尽管存在依赖风险,但其能力令人印象深刻,期待未来模型的发布。

使用 Cline + Gemini 2.5 Pro 来做 Vibe coding

/home/rook1e
/home/rook1e · 2025-04-28T11:44:45Z
斯坦福2025 AI Index报告来了:DeepSeek在全文中被提到45次

斯坦福大学发布的《2025 AI Index》报告分析了人工智能的发展现状,指出美国在模型发布方面领先,中国迅速追赶。报告强调训练成本上升、推理成本下降,人工智能的碳足迹仍在增加。尽管企业投资持续增长,实际回报尚未显著。报告还提到人工智能在医疗领域的潜力,以及美国政策向州级转变。总体来看,公众对人工智能持乐观态度。

斯坦福2025 AI Index报告来了:DeepSeek在全文中被提到45次

机器之心
机器之心 · 2025-04-08T05:31:11Z
Qwen2.5-1M: 支持100万Token上下文的开源Qwen模型

Qwen2.5-1M模型正式发布,支持1M上下文长度,包含两个新开源模型。推理框架速度提升3-7倍,长文本任务表现优于128K版本,短文本任务性能保持稳定。模型采用稀疏注意力和长度外推技术,优化推理效率,未来将继续提升性能和应用范围。

Qwen2.5-1M: 支持100万Token上下文的开源Qwen模型

Blog on Qwen
Blog on Qwen · 2025-01-26T16:00:03Z
OpenAI成立了一个可以暂停模型发布的‘独立’安全委员会

OpenAI成立了一个独立的安全委员会,拥有推迟模型发布的权力,以应对安全问题。该委员会将在90天内进行审查并提出建议,旨在加强模型发布的监督。委员会成员包括公司领导,独立性尚不明确,此举类似于Meta的监督委员会,旨在促进AI行业的安全合作与信息共享。

OpenAI成立了一个可以暂停模型发布的‘独立’安全委员会

The Verge
The Verge · 2024-09-16T22:08:32Z
Qwen1.5 介绍

通义千问Qwen1.5模型发布,包含多种规模的Base和Chat模型,提升了多语言处理能力和人类偏好对齐。新版本支持32768个tokens的上下文长度,性能在各项基准测试中表现优异,特别是Qwen1.5-72B模型。该模型已与Hugging Face transformers集成,简化了开发者的使用体验,支持多种框架。

Qwen1.5 介绍

Blog on Qwen
Blog on Qwen · 2024-02-04T05:33:00Z

本研究引入了 CrisisTransformers,用于分析危机相关的社交媒体文本。经过广泛的语料库训练和评估,结果表明 CrisisTransformers 在所有数据集的分类任务中都优于强基线,句子编码器在句子编码任务中将现有技术水平提高了 17.43%。所有模型已公开发布,成为分析危机相关社交媒体文本任务的强大基准。

危机转型:面向危机相关社交媒体文本的预训练语言模型和句子编码器

BriefGPT - AI 论文速递
BriefGPT - AI 论文速递 · 2023-09-11T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码