小白我要学实用 Agent 教程与工具实测
目录

验证 Lab · 策展层级 4

GitHub AI 项目首次试跑 Lab

用固定输入、真实输出、机器检查和独立复核,判断一个 GitHub 项目是否完成了你要的任务。

完成结果为一个项目生成可审计证据包:版本、环境、固定输入、实际输出、时间、费用、报错和最终决定。

查看本文目录

证据与适用边界

本站已完成 MarkItDown 0.1.6 的四文件同题试跑;Dyad、Dify、n8n 和 ComfyUI 尚未实测。当前结果只覆盖一台 Windows 机器和四份自有合成文件。。该标记与来源核验状态独立,不代表使用效果。

预计时间
每个项目按环境预留 45 到 120 分钟;MarkItDown 本轮的四次缓存转换各约 4.0 到 6.0 秒,准备夹具和验收不包含在内。
成本边界
默认使用虚构数据、免费或本地路径并设零付费预算。MarkItDown 本轮未用 API key、外部 LLM、OCR、Azure 或付费服务;其他项目仍须单独评估。
证据状态
官方来源与本站实测均已公开
最后核验
2026-07-23
生命周期
当前维护
评分覆盖
0%;综合评分 未计算

一张卡已完成,其余继续排队

MarkItDown 已实际执行基准任务、保存输入输出和机器记录,并由独立 Reviewer 复查,因此对应 Resource 改为已实测。其余四张卡仍只来自所有者材料,不能继承这个状态。

本节来源

一次只试一个可替换节点

从应用生成、AI 工作流、自动化、图像 Workflow、文档转换中选择一个与当前任务最匹配的节点。其余项目留在 Queue 或 Collection,不并行安装。

  1. 冻结试跑范围

    操作
    复制项目试跑卡,只填写一个项目、一个固定输入和一个输出。
    你应该看到
    试跑能在两小时内明确通过、失败或证据不足。
    如何确认
    卡片写明不做什么和停止条件。
    卡住时
    • 范围超过一个核心结果时,删到最小。

本节来源

执行、保存并独立复查

按 Workflow 隔离环境并运行。复查者应能从记录判断实际发生了什么,而不是只看到成功截图。失败结果同样保留,因为它能淘汰不合适的节点。

  1. 形成证据包

    操作
    保存版本、环境、命令或界面路径、输入、输出、用时、费用和原始错误;清除所有密钥与个人数据后再共享。
    你应该看到
    证据足以支持继续、替换或放弃。
    如何确认
    由未参与执行的人按试跑卡逐项检查。
    卡住时
    • 证据缺字段时保持尚未实测,不补写推测。

本节来源

测试状态变更规则

一次本地成功只证明特定版本、环境和输入。更新 Resource 时必须限定范围;安装失败或输出不合格时写失败,不以所有者演示替代。MarkItDown 当前为有边界的已实测;其余四个项目保持尚未实测。

本节来源

内容关系