GPT-6 Astra 实测对比:不同推理强度下的 SVG 绘图能力横评
开发者实测 GPT-6 Astra 的 SVG 绘图能力,并在不同推理强度下与 GPT-5.6 多款模型进行了横向对比。
AI 深度解读
Simon Willison 发布了一组 GPT-6 Astra 与 GPT-5.6 系列模型生成“骑自行车的鹈鹕”SVG 的对比网格,按不同推理强度并列展示结果,关注价值在于它把视觉生成质量、推理预算和输出长度放在同一案例中观察。
- 测试覆盖 Astra 的低、中、高、超高和最高推理级别,并与 GPT-5.6 的多个型号比较。
- 作者认为 Astra 在该任务中的图形完整性和形象可辨识度更稳定,但低于最高级别时仍可能遗漏画面一侧的鹈鹕腿部。
- 对比网格同时展示了输入输出 token 数量,提示相同提示词下不同模型的计算路径并不一致。
- 该案例是单一 SVG 创作任务,不等同于通用视觉能力或严谨基准测试;结果还受提示词、渲染方式和主观评价影响。
- 影响/看点:这类低成本可复现实验可能帮助开发者选择推理档位,但能否外推到产品设计、代码图示或复杂视觉任务,取决于更多任务样本和统一评测标准。
- 资料依据:
- Simon Willison 博客(2026-09-04):https://simonwillison.net/2026/Sep/4/astra-pelicans/
- Pelican 对比网格(2026-09-04):https://static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html
本内容由 AI 生成,仅供参考,请注意甄别