先给结论:只承诺“能出多少篇”而不说明来源,数量本身不能作为价值依据。你能执行的最小动作,是从对方已交付或试稿的内容里抽一篇,用可复现的检查把它拆成“来源可追溯部分”和“无法追溯部分”,再看后者是否构成主要篇幅。如果无法追溯部分占了大头,数量再大也只能当作待处理素材,不能直接进入发布流程。
假设对方给了你一批成品,说“每篇都过检测、可直接用”,但不提供素材出处。你不需要完整数据或后台权限,也能做一次抽查。动作是:随机抽一篇,逐段标注每个事实、数字、专有名词、引语的来源类型,分成三类——可回指来源(能追到某份公开文件、某次公开访谈、某个可查记录)、可自证表述(观点、常识、方法描述,不需要外部出处)、悬空陈述(像事实但找不到出处,也不属于通用常识)。
这个动作的结果直接决定下一步:如果悬空陈述只占零星几句,你可以把它标出来要求补来源,其余部分继续评估;如果悬空陈述构成主体段落,说明这篇的“数量”是靠不可验证内容撑起来的,后续再抽两三篇大概率同构,此时应停止按篇数计价,改为按可追溯信息量重新谈。
不说明来源时,“数量”至少混进了三种互不相同的成本,核对时要分开看:
因此“只承诺数量”在报价上看似便宜,实际是把后两项成本留给了使用方。核对价值时,应该把这三项折算进去,而不是只比较单篇价格或总篇数。
一个可操作的替代指标是来源密度:可回指来源所覆盖的段落数 ÷ 全文段落数。它不完美,但比篇数更接近实际可用程度。举个假设例子说明比较方法:A 交付 50 篇,抽查 5 篇,平均来源密度约两成,其余为悬空陈述;B 交付 10 篇,抽查 5 篇,平均来源密度约七成,少量悬空处已标注待补。若你的用途需要事实准确,B 的可直接使用量可能高于 A,尽管 A 的篇数是 B 的五倍。这里的关键不是具体百分比,而是用同一把尺子去量不同交付,避免被总数带偏。
需要说明适用条件:来源密度只适用于以事实、数据、引语为主的内容。如果内容本身是评论、经验叙述或方法说明,可自证表述占比高是正常的,此时应改用“悬空事实句数量”来判断,而不是强求每段都有外部来源。
抽查中会出现一些容易被过度解读的现象,需要区分:
这些区分决定了你的下一步:把无法追溯当作待验证项,而不是先下结论,才能避免误伤可用内容,也避免放过真正的悬空主体。
完成抽查后,按悬空陈述的占比和位置分档处理:
同时把要求写进下一次约定:每篇附来源清单,注明每个事实对应的可核对指向,抽查不合格时的处理方式。这样数量承诺才有对应的质量边界,核对也从一次性怀疑变成可重复的流程。