聚焦大语言模型领域,每日精选 Top 10
2026 年 8 月 26 日 · 星期三
据爆料,OpenAI 已完成内部代号为 "Bel" 的新一代大模型预训练,参数规模超 10 万亿,被视为向 AGI 阈值迈进的关键一步。消息引发 IT 之家、DoNews、CoinDesk 等多家媒体跟进报道。
OpenAI 发布与博通合作开发的首款定制推理芯片 Jalapeño,在 GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T 上测试显示:每瓦 AI 算力提升 1.5-1.9 倍,延迟降低 1.7-3.6 倍,全面超越 Nvidia GB200/GB300。
OpenAI 宣布未来 3 个月内 GPT-5.6 Sol 的 API 和积分价格下调超 20%,同时为符合条件的 ChatGPT Work 和 Codex 计划用户引入新积分体系,进一步降低大模型使用成本。
DeepSeek 推出实验性多模态模型 V4-Flash-Vision-Exp,文本性能与 V4-Flash 持平,Agent 基准测试接近 Claude Opus-4.8。同时上线新 Files API 和 Harness 支持,深化开发者生态。
字节跳动正式推出面向生产力场景的 Agent 产品"豆包工作",与飞书办公套件深度集成,覆盖文档处理、会议纪要、任务协作等企业场景,标志着大模型 Agent 正式进入主流办公生产力工具赛道。
Meta 计划未来几周推出面向消费者的 AI 助手产品"Hatch",并将于 10 月发布新一代大模型"Watermelon"。Meta 在消费级 AI 助手领域加速布局,与 OpenAI、Google 形成正面竞争。
Anthropic 宣布设立 500 万美元资助计划,支持独立研究机构开展 AI 对用户福祉影响的评估研究。同时发布 Anthropic Economic Index,提供各职业 AI 使用情况数据,推动 AI 影响的透明化评估。
Anthropic 演示 Claude 自主设计蛋白质结合剂的能力,成功率达 22-35%,远超行业常规的 10-15%。相关提示词和数据已开源,有望加速药物研发进程,标志着 LLM 在生物医学领域的实质性突破。
最新数据显示,中国大模型周调用量达 40.48 万亿 Token,连续 17 周超越美国。DeepSeek-V4-Flash 连续三周位居全球模型调用量第一,中国大模型在应用规模和生态活跃度上持续领跑全球。
Mistral AI 宣布与沙特 HUMAIN 达成战略合作,共同开发聚焦网络安全、语音和阿拉伯语性能的本地化前沿模型,覆盖沙特及中东地区。欧洲模型厂商加速全球化布局,与中美形成差异化竞争。