GPT-5.5正式发布:OpenAI把AI代理推向真实工作流
2026年4月23日,OpenAI正式发布 GPT-5.5。和此前 GPT-5.5 只停留在传闻阶段不同,这次官方给出的定位很明确:它不是单纯更会聊天的模型,而是面向复杂真实工作的下一代模型,重点放在编程、联网研究、数据分析、文档和表格生成、软件操作,以及跨工具持续完成任务。 这件事值得关注,是因为...
2026年4月23日,OpenAI正式发布 GPT-5.5。和此前 GPT-5.5 只停留在传闻阶段不同,这次官方给出的定位很明确:它不是单纯更会聊天的模型,而是面向复杂真实工作的下一代模型,重点放在编程、联网研究、数据分析、文档和表格生成、软件操作,以及跨工具持续完成任务。 这件事值得关注,是因为...
Qwen3.6-Max-Preview 已上线,这是 Qwen 公开预览的下一代旗舰模型。按照官方说法,这一版本相较 Qwen3.6-Plus,重点补强了 agentic coding、世界知识和指令遵循能力,同时把真实世界任务中的可靠性再往前推了一步。对国内大模型市场来说,这更像一次面向“可执行 ...
Qwen Code 在 v0.14.0 至 v0.14.2 连续更新,把 AI 编码助手从“会写代码”继续推向“可托管、可编排、可分工”的方向。新版本覆盖远程控制、定时任务、模型分配和规划式执行几个核心环节,目标很明确:让开发者把更多重复性操作交给 AI,在手机、服务器和本地工作流之间打通闭环。 远...
Anthropic 最新发布的 Claude Mythos Preview ,没有按常规大模型节奏面向大众开放,而是先放进防御性网络安全研究场景。原因很直接:这款模型在零日漏洞发现、利用链生成和逆向分析上的能力,已经逼得大模型公司先谈安全边界,再谈产品扩张。 Mythos Preview先被放进安全...
GLM-5.1 正式发布,Z.ai 将其定义为面向 agentic engineering 的新一代开源旗舰。官方资料显示,这款模型主打代码、工具调用与长时自主执行,在 SWE-Bench Pro、NL2Repo 和 Terminal-Bench 2.0 等任务上给出一组靠前成绩,同时把单任务连续自...
Cursor 近日披露,其在 Blackwell GPU 上重构了 MoE 模型 的 token 生成路径,并将这套方法命名为 warp decode。官方称,这项底层优化带来 1.84 倍推理吞吐提升,同时让输出结果更接近 FP32 参考值;相关改进也已用于 Composer 的训练流程,以加快模...