1xBET

文本分析软件Leximancer概想计数和多种说话建模

欢迎您接见环中1xBET!

在Leximancer中 ,概想是一组在文本中一路传布的有关单词(术语)。证据词蕴含同义词和形容词。Leximancer概想以种子词起头 ,种子词由Leximancher自动发现或手动指定用于编码。Leximancer的进建过程将概想种子界说演造成一个齐全的词库。概想能够像单词一样 ,也能够像名字一样(专有名称 ,如Peter)

?

词典概想计数能够与文档中的手动单词计数进行比力吗?

不是。Leximancer萦绕单词成立概想族 ,而后使用这些概想族对存在多个概想的每两个句子块进行编码或分类。

Leximancer统计蕴含一个概想的整个2个句子片段 ,而不是单词的沉复。此表 ,还将存在用不蕴含单词的概想编码的文本段。

把稳:两个句子块的大幼是默认值 ,能够更改。其他项目设置可能会影响Leximancer处置文本的方式以及由此产生的概想计数。

?

你能在统一个词汇分析/地图中为多种说话建模吗?

是的 ,但了局可能不是你想要的。Leximancer不执行自动翻译 ,因而来自分歧说话的两个意思一样的概想不会使用通常文本数据自动归并。由此产生的映射对于每种说话都有很大水平上独立的概想集群。您能够手动跨说话归并集线器概想 ,若是归并足够多 ,说话集群就会归并。

要在统一项目中映射来自多种说话的数据 ,必须执行两件事:

  • 为项目选择每个数据集时 ,指定它们的说话 ;
  • 必须在非索引字表编纂器中(使用顶部的“加载说话”按钮)为每个附加说话加载非索引字清单。

?

有关文章?
更多文章 →

?

  • ?
查看Leximancer软件详情

热点资讯

2024-02-20 14:30
首页    技术文档    文本分析软件Leximancer概想计数和多种说话建模
【网站地图】