GPT-6 Astra 实测对比:不同推理强度下的 SVG 绘图能力横评

📡 Simon Willison 博客2026-09-05 07:59

开发者实测 GPT-6 Astra 的 SVG 绘图能力,并在不同推理强度下与 GPT-5.6 多款模型进行了横向对比。

AI 深度解读

Simon Willison 发布了一组 GPT-6 Astra 与 GPT-5.6 系列模型生成“骑自行车的鹈鹕”SVG 的对比网格,按不同推理强度并列展示结果,关注价值在于它把视觉生成质量、推理预算和输出长度放在同一案例中观察。

  • 测试覆盖 Astra 的低、中、高、超高和最高推理级别,并与 GPT-5.6 的多个型号比较。
  • 作者认为 Astra 在该任务中的图形完整性和形象可辨识度更稳定,但低于最高级别时仍可能遗漏画面一侧的鹈鹕腿部。
  • 对比网格同时展示了输入输出 token 数量,提示相同提示词下不同模型的计算路径并不一致。
  • 该案例是单一 SVG 创作任务,不等同于通用视觉能力或严谨基准测试;结果还受提示词、渲染方式和主观评价影响。
  • 影响/看点:这类低成本可复现实验可能帮助开发者选择推理档位,但能否外推到产品设计、代码图示或复杂视觉任务,取决于更多任务样本和统一评测标准。
  • 资料依据:
  • Simon Willison 博客(2026-09-04):https://simonwillison.net/2026/Sep/4/astra-pelicans/
  • Pelican 对比网格(2026-09-04):https://static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手