验证 Lab · 策展层级 4
Agent Builder Lab 公开站点证据练习
只用公开页面区分可独立核验的线上事实与尚未公开的内部验证记录。
完成结果学会只根据公开网址声明页面存在,并把内部 build、测试或浏览器验收留在外部无法核验的范围。
查看本文目录
证据与适用边界
本站已完成 UI Skill(交给 Agent 使用的一组规则)第一轮内部评测,但公开站点教程本身还没有第一次做网站的人独立完成。首轮可理解性由编辑内部检查,尚未经过真实读者验证。本轮只完成 90 分项目;稳定性 10 分尚未测试。模型标识未保留,无法核验各组模型配置是否一致。这不是用户研究或排行榜。。该标记与来源核验状态独立,不代表使用效果。
- 预计时间
- 阅读与检查约 15 分钟。
- 成本边界
- 本练习免费公开;访问公开站点可以验证页面是否可达,但不能证明教程效果、内部工程记录或你自己的部署结果。
- 证据状态
- 官方一手来源已核验
- 最后核验
- 2026-07-14
- 生命周期
- 当前维护
- 评分覆盖
- 0%;综合评分 未计算
先检查任何人都能看到的事实
外部读者可以打开 https://www.buildmemobrick.com/,读取当前首页内容并沿公开导航进入 Topic、Workflow、Guide、Lab 与 Search。这里可以声明的是这些公开页面在检查时可访问,而不是它们如何在私有工作区被生成。
- 生产站点使用 https://www.buildmemobrick.com/
- 公开导航展示长期内容类型
- 页面明确把 localhost 与公开网址分开
- 没有真实行为数据时不把 Trending 或 Popular 当作事实
本节来源
- Agent Builder Lab production site核验于 2026-07-14
把内部工程记录留在证据边界内
公开页面不能证明内部的 build、测试或浏览器验收,也不能证明某次本地命令、自动检查或发布审查真的执行过。本站不在公开 Lab 中把这些内部记录写成外部读者可以独立核验的事实。
本节来源
- Agent Builder Lab production site核验于 2026-07-14
仍未证明教程对第一次做网站的人有效
还没有一行代码都不会写的人独立完成这套教程,因此这里不能声称教程已经好学、能让人成功部署或具有搜索需求。下一步仍需真实操作,并记录在哪个界面、术语或授权步骤卡住。
本节来源
- Agent Builder Lab production site核验于 2026-07-14
公开网址只能证明公开访问这一关
网站能打开,不等于按钮、页面状态、手机操作、隐私、SEO 和回退都已通过。使用产品化七项检查时,要为每一关留下独立证据,并把未检查项写成未完成。
检查两条公开网址和一个真实动作
- 操作
- 关闭本地服务,在无痕窗口打开首页和一条深层链接,再完成一个不涉及真实隐私数据的核心动作。
- 你应该看到
- 两页可访问,核心动作产生清楚结果,失败时不会假装成功。
- 如何确认
- 记录网址、时间、动作输入、输出和未检查的其余闸门。
- 卡住时
- 只有截图时重新打开真实网址。
- 动作依赖真实账户或付款时先改用无害测试路径。
本节来源
- Agent Builder Lab production site核验于 2026-07-14
- Lovable Publish documentation核验于 2026-07-14
- Vercel Production checklist for launch核验于 2026-07-14
复用公开网址验收顺序
官方部署文档可以说明平台支持的机制,但你的完成证据必须来自自己的公开网址。先验收平台部署首页,再验收一个深层链接,最后才处理自定义域名;每一层都保留独立地址和检查时间。
区分平台网址与自定义域名
- 操作
- 关闭本地服务,在无痕窗口分别打开平台部署首页、一个深层链接和已配置的自定义域名。
- 你应该看到
- 每个公开地址都无需你的账户登录即可显示预期页面。
- 如何确认
- 记录地址、检查时间、页面标题和失败状态;localhost 截图不计为上线证据。
- 卡住时
- 平台网址失败时先查构建;只有平台网址正常而域名失败时才进入 DNS 排查。
本节来源
- Astro Vercel guide核验于 2026-07-11
- Vercel Git Deployments核验于 2026-07-11
同一道网页题怎么评测
第一轮固定一份中文任务说明、起始要求和每组一次运行;A 组不读取 Skill,另外三组分别使用 frontend-design、design-taste-frontend 和 UI UX Pro Max。原始运行记录没有保留模型标识,无法核验各组模型配置是否一致。
评分规则在看结果前锁定。首轮可理解性由编辑内部检查,尚未经过真实读者验证;按钮、表单、手机宽度、键盘、控制台和降低动态效果则由统一浏览器检查。
本节来源
- Agent Builder Lab UI Skill first-round results核验于 2026-07-14
第一轮结果和八张首屏证据
五项维度依次为:无 Skill 基线 20+20+20+15+15=90,frontend-design 20+20+19+15+15=89,design-taste-frontend 20+20+20+14+12=86,UI UX Pro Max 20+20+20+14+15=89。分差达到或超过 3 分才形成明确胜负;最高三组只差 1 分,低于 3 分胜负线,因此第一名没有明确赢家。
四组都在 1440×1000 桌面和 390×844 手机窗口完成检查,共保存 8 张首屏截图;浏览器功能失败为 0。这个数字只覆盖本轮规定的按钮、表单、FAQ、锚点、控制台、横向滚动和降低动态效果检查。
本轮只完成 90 分项目;稳定性 10 分尚未测试。








本节来源
- Agent Builder Lab UI Skill first-round results核验于 2026-07-14
这些结果能说明什么,不能说明什么
这次只能说明四组在一份具体任务说明里的单次结果。首轮可理解性由编辑内部检查,尚未经过真实读者验证。模型标识未保留,无法核验各组模型配置是否一致。
因此不能把 90、89、86、89 写成长期能力、通用易用性、排行榜或购买建议,也不能说某个 Skill 一定更好。八张图让你核对本轮首屏差异,公开结果 JSON 让你核对分数和浏览器检查数字。本轮只完成 90 分项目;稳定性 10 分尚未测试。
本节来源
- Agent Builder Lab UI Skill first-round results核验于 2026-07-14
下一轮先检查修改会不会把页面弄坏
按预先锁定的筛选规则,无 Skill 基线和 UI UX Pro Max 进入下一轮,各做三次新运行,再把衣柜价格改为 ¥459 起并增加书桌服务。这个安排只是减少第二轮工作量,不是推荐结论。
下一轮要记录同一修改是否破坏阅读顺序、手机排版和代码一致性。完成前,修改稳定性继续写“尚未运行”。
本节来源
- Agent Builder Lab UI Skill first-round results核验于 2026-07-14