主推
OpenAI 发布 GPT-5.2:推理能力大幅跃升,API 价格再降 40%
GPT-5.2 在数学、代码与科学推理基准上全面刷新纪录,API 价格下调 40%,智能体任务可靠性显著提升。
编辑短评: 推理成本的持续下降正在改写 AI 应用的经济学账本,这可能是今年对开发者最重要的一次模型发布。
技术前沿 2 min read
GPT-5.2 在数学、代码与科学推理基准上全面刷新纪录,API 价格下调 40%,智能体任务可靠性显著提升。
编辑短评: 推理成本的持续下降正在改写 AI 应用的经济学账本,这可能是今年对开发者最重要的一次模型发布。
Claude 4.5 将连续自主编程时长推至 30 小时,配合全新的检查点机制,长任务中断恢复不再丢上下文。
编辑短评: 智能体赛道的竞争焦点正在从"单题分数"转向"工程续航",Anthropic 这一步踩得很准。
DeepSeek-V4 采用稀疏混合专家架构,以极低训练成本登顶多项开源基准,权重与训练细节同步开放。
编辑短评: 当开源模型以闭源十分之一的成本逼近旗舰水平,"性价比"本身就是最锋利的竞争武器。
欧盟《AI 法案》第二阶段正式生效,通用大模型提供商需履行透明度与版权义务,首批罚则同步公布。
编辑短评: 合规不再是法务部门的事,训练数据溯源正在成为模型发布流程中的硬性环节。
Google 将 Gemini 3 深度整合进 Docs、Sheets 与 Gmail,企业版新增跨应用智能体工作流。
编辑短评: 办公套件正在成为 AI 能力的最佳落地点——离工作流越近,付费意愿越强。