2026-08-05
📰 9 条要闻 🌐 10 个权威信源 ⏰ 24-48h 实时
阿里于8月3日发布Qwen家族迄今最强大的模型Qwen3.8-Max,参数规模2.4万亿,激活参数95B,支持100万上下文Tokens,在编程、办公、科研等能力上全面提升,将于下周开源模型权重及Qwen3.8-27B。Arena榜单仅次于Claude,全球大模型第一梯队。
稀宇科技于8月3日正式开源H3视频模型,该模型将文本、图像、视频、声音四类输入放入同一多模态上下文处理,输出原生双声道音视频,最高支持15秒2K分辨率,默认输出2K每秒价格不到主流模型的三分之一,面向影视、广告、电商、游戏等商业场景。
Anthropic于7月24日发布Claude Opus 5,上线1M token上下文窗口(默认和最大均为1M),128k最大输出tokens,thinking默认开启,定价与 Opus 4.8相同($5/$25 per MTok),编程、知识工作和科研能力全面提升,成为Claude Pro默认模型。
白宫科技政策顾问克拉齐奥斯(7月22日)发文称,月之暗面通过蒸馏技术从Anthropic的Claude Fable AI模型提取能力来开发K3,并可能使用了受限制的英伟达GB300服务器训练。月之暗面此前已于7月16日发布K3(2.8万亿参数),并于7月27日宣布开源。
据华尔街日报7月28日报道,百度计划最迟在8月底推出一款能处理更复杂任务的新型推理模型,以与DeepSeek和OpenAI等公司竞争。同时百度还计划在未来几个月内推出核心基础模型文心大模型的新版本(ERNIE 5.0)。
OpenAI于7月30日发布ARC-AGI-3基准评测,探讨如何通过两个设置将分数提升3倍;同时发布GPT-5.6详细技术报告,阐述其如何融合前沿智能与效率;7月31日发布Building abundant intelligence战略文章;8月3日推出GPT Live持续语音交互功能。
据智能纪元AGI(7月28日)报道,DeepSeek V4正式版可能推迟至8月10日至20日之间发布,封闭测试已启动。同时DeepSeek已口头通知部分潜在投资者暂停第二轮融资谈判,相关融资仍可能变化。