OpenAI即将发布GPT-5.4,百万级上下文窗口 2026年9月3日 by WoodStone OpenAI新一代旗舰GPT-5.4将上下文窗口上限提升至100万token,新增Tool Search并首次内置原生计算机使用能力,电子表格建模得分跃升至87.3%,面向专业工作场景的定位愈发清晰…
Azure OpenAI推出推理模型:GPT-5系列与o3-mini正式上线 2026年9月1日 by WoodStone Azure OpenAI正式推出GPT-5系列与o3-mini推理模型。GPT-5系列推理能力显著提升,o3-mini高效轻量,企业可通过Azure平台获得企业级安全合规与弹性扩展等能力支持…
什么是GPT?GPT-4、GPT-5及更多版本全面解读 2026年8月10日 by WoodStone GPT是生成式预训练Transformer的缩写,是能理解并生成自然语言的大型语言模型家族。GPT-1到GPT-5经历了从15亿参数到1750亿参数的跃升,GPT-4已实现多模态(图像+文本),GPT-5研究预览已发布,ChatGPT现基于GPT-5模型…
GPT-5.6 Sol刷新ARC-AGI-3基准测试:OpenAI反驳Anthropic优势论 2026年7月31日 by WoodStone OpenAI最新公布的基准测试数据显示,其旗舰模型GPT-5.6 Sol在ARC-AGI-3逻辑推理基准测试中达到38.3%的得分,一举超越Anthropic旗舰Claude Opus 5的30.2%,后者此前刚刚以四倍成绩刷新了该基准的历史记录。值得注意的是,GPT-5.6 Sol的标准测试得分仅…
GPT-5 被多国监管机构标记为潜在高风险 AI 模型:合规审查全面启动 2026年7月29日 by WoodStone 2026 年 7 月 29 日,欧盟 AI 办公室、美国 AI 安全研究所、英国 AI 安全研究所三大监管机构同步发布公告,将 OpenAI 最新发布的 GPT-5 系列模型列为”潜在高风险 AI 模型”,启动为期 90 天的合规审查程序,审查期间模型在欧盟成员国与英国的部分应用场景将被限制部署。触发监管标记的核心原因是 GPT-5 在多项前沿能力评估中得分突破预设阈值,包括:自主多步推理能力达到…
GPT-5.4 Mini 与 GPT-4o Mini 对比 (2026):中文场景选型与成本实测 2026年7月28日 by WoodStone 在人工智能领域,OpenAI 一直是行业的领跑者。2026 年,OpenAI 推出了两款轻量级模型:GPT-5.4 Mini 和 GPT-4o Mini。这两款模型专为资源有限但对 AI 性能有较高要求的用户设计,引起了广泛关注。对于许多科技爱好者来说,如何在这两者之间做出选择是一个值得深思的问题…
GPT-5在注意力测试中表现不佳 2026年6月18日 by WoodStone GPT-5在Stroop任务中表现不佳,暴露AI在处理持续竞争信息时的弱点。研究表明,AI的注意力机制与人类存在显著差异。这一发现为AI改进提供新方向,提示单纯刷榜分数不能代表真实能力…
OpenAI发布专用网络安全模型GPT-5.4-Cyber,正面对决Anthropic旗下Mythos 2026年5月9日 by WoodStone 当地时间4月15日,OpenAI正式发布旗下首款专用网络安全大语言模型——GPT-5.4-Cyber。这款模型被定位为专门服务于安全研究人员的AI助手,能…