如何评估AI生成内容的质量?

AI可以创作出不错的内容,在它们最初的原始形式下,它们肯定不会精彩、深刻,但它们可以令人满意。

这取决于是否会如此?根据我的经验,主要取决于:

  • 创作者懂得如何写作。
  • 创造者了解人工智能的能力,知道如何最大化利用它们。

但一个没有经验的文案写手怎么可能知道AI生成的内容好坏呢?下面,我整理了一份值得关注的具体方面清单。

1.定义文本的目的,并确定其是否能满足该目的

AI往往会倾泻而下,然后逃避到安全的泛泛而谈,如果某篇文章本应销售某种特定产品,而读了三段后我们仍然不明白它为什么值得购买,那人工智能就失败了。一篇好的文章必须传达具体内容,而不仅仅是为了在网站上美观或填满空间。

要评估这一点,请问自己以下问题:

  • 读完文本后,知道接下来该做什么吗?买了,注册了,明白问题所在?
  • 能用一句话总结这篇文章的主要价值吗?否则,信息会模糊,几乎没人会记得。
  • 这篇文章是否回答了真正的问题,还是仅仅围绕着这个话题展开?
  • 有没有具体的例子,比如数字、示例、各种情景?它们建立了信誉,而人工智能本质上并不具备这种信誉。
  • 在删除了一些句子(尤其是单个段落的开头句子)后,文本的含义是否保持不变?如果是这样,就需要缩短,文字被简单地拉长了。

2.检查文本是否带来了新的信息或视角?

人工智能擅长综合现有信息,问题在于,当文本只是重复那些在其他地方大量提供的明显论点、定义和建议时。一篇有效的文本必须带来独特的视角,在AI内容泛滥的时代,读者立刻感受到缺乏真实性。

所以从以下角度分析:

  • 这篇文章是否为互联网带来了任何附加价值,还是只是现有内容的又一个简化版本?
  • 有没有真实经历的描述?
  • 有行业特定的词汇表吗?
  • 人工智能是否得出了不显而易见的结论?

例如,还要加上案例研究、独特的观察甚至有争议的观点,算法不会自行冒险使用,以免冒犯任何人。请记住,原创性是通过细节、特定的幽默感或大胆的论点来构建的,这也是人工智能还需要向我们学习的。

3.确保文本在风格上保持一致

当文本分阶段创作,使用多个提示时,这一点尤为重要。AI在一段话里可能是我们的好朋友,使用缩写和宽泛的语言,而在另一段中,突然且毫无预警地变成一个滥用被动语态。

这种风格上的混乱立刻暴露出文本并非出自人类之手,最重要的是,这类文本本身就很难读。

一次性读完整篇,最好是朗读,检查段落之间的过渡是否自然,且文本的氛围在开头和结尾是否一致。

4.速率的流畅性和阅读便利性

优质内容自然流畅,阅读起来轻松自如,然而,人工智能有一种特定的句子构建方式,其长度和结构几乎相同。这造成了一种乏味、单调的节奏,让读者昏昏欲睡。还常常存在一些奇怪的逻辑结构,号称语法正确,但没有人类会写或说出它们。

注意文本是否难读,难道不是形容词和反复复杂的句子过多,需要反复阅读才能理解它们的意思吗?

缩短冗长的句子,加入一些动态,并确保思绪之间有顺畅的过渡。

5.核实事实和来源

人工智能几乎可以自信地提供虚假信息,关于日期、姓名、统计数据或研究结果的幻觉是语言模型的基本原理。

无论如何,都不要发布未经来源核实的数据或事实,有时候,复制它们并用谷歌搜索就足够了。

如果AI提供来源链接,点击它们,它们常常发现,这些页面或文章往往不存在,内容完全不同。记住,实质性错误的责任将落在我们自己身上,而不是算法。

6.注意AI专用的短语

在各种社交渠道或文章中,许多人对某些短语的使用进行污名化,这些短语正是人工智能的特征。这导致我发现自己在想用“key”这个词时,脑海里会寻找同义词,只要听起来不像GPT模型。

这是正确的做法吗?我对此持怀疑态度,不过,如果希望AI生成的文本听起来不像AI文本,就值得关注这些短语。

事实是,它们的存在让文本明显被人工智能写成,但它们本身并不有害,也不会影响文本的价值。然而,如果想隐藏文本的作者身份,或者觉得这大部分是我们的,那么去除这些词语是值得的。

摘要

AI对文本质量的最终检验,不是它能否通过检测器(而这些检测器本身效果也不好),而是它是否对接收者有价值。人工智能是个出色的助手,但决策能力很差。我们需要知道文本何时已呈现预期水平,何时是正确的外壳。

还要记住一个关键点问题,人工智能没有品味和同理心,它不知道什么能打动目标受众,它不了解客户,也不了解行业的细微差别。

评估内容时,不要只是语言错误的校对者。成为价值观的策展人。如果处理后的文本带来了难以一键生成的内容,那就走在正确的道路上。如果保持原始版本,就有可能让它消失在一片相同、安全且最终多余内容的海洋中。

👋 感谢您的观看!

© 版权声明
THE END
喜欢就支持一下吧
点赞0 分享