我把同一个 UI 需求交给同一个模型跑了 9 次:不加 Skill、apple-design、ui-ux-pro-max 各 3 次。


结果让我改了判断方式:同一套 Skill 也会一次很好、一次翻车。
9 份结果匿名后交给两个人独立打分,三组均分是:
apple-design 91.3
ui-ux-pro-max 89.0
不加 Skill 85.8
但三组都没做到 3/3 零缺陷。
apple-design 和不加 Skill 各有一次手机详情页主按钮挤坏;ui-ux-pro-max 有一次在 375px 窄屏横向溢出,右侧内容被截断。每组也都漏过无障碍细节:有的是表单没标签,有的是图标按钮没名称。
这次 apple-design 均分最高,ui-ux-pro-max 波动最小。我会复用的是后面的验收方法。
以后我不会再拿一张漂亮截图判断 Skill:先跑 3 次,再验手机、键盘、减少动态效果和失败项。对我来说,Skill 更像设计偏置,不是稳定性保证。
post-image
此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
  • 赞赏
  • 评论
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
暂无评论
  • 置顶