利索能及
我要发布
收藏
专利号: 2023108089120
申请人: 北京凌霄文苑教育科技有限公司
专利类型:发明专利
专利状态:已下证
更新日期:2026-09-16
缴费截止日期: 暂无
联系人

摘要:

权利要求书:

1.一种数字经济领域基于语言逻辑学的文本特征检索方法,其特征在于:包括以下步骤:

S1、建立识别库,识别库分为两个区,分别是识别区与存储区,对撰写好的方案内容进行提取,将提取到的内容载入到所述识别区,所述存储区中储存有若干个不同的方案;

S2、识别区对提取到的内容进行一级分类,得到一级分类结果,一级分类分为方法类和结构类,一级分类方法是对提取到识别区的内容进行词语识别,在方案的具体内容的项目中分别统计动词与名词的数量,当动词数量大于名词数量时分为方法类,当名词数量大于动词数量时分为结构类;

S3、识别区对一级分类结果进行二级分类,得到二级分类结果,二级分类方法的具体过程为:统计实践操作项目中的相同词语的使用频次,并根据词语的词性和使用频次进行分类,方法类分为目标群体、过程和结果,结构类分为部件、连接和驱动;

S4、将二级分类结果与存储区中的内容进行筛查,确定相似方案;

S5、将本方案与相似方案进行比较,计算得出重复度;

S6、将相似方案按照重复度从高到低依次输出。

2.根据权利要求1所述的数字经济领域基于语言逻辑学的文本特征检索方法,其特征在于:所述步骤S1中,撰写方案的格式统一,撰写包括三个项目,分别是领域作用、具体内容和实践操作。

3.根据权利要求2所述的数字经济领域基于语言逻辑学的文本特征检索方法,其特征在于:所述步骤S4中,筛查的过程为:在领域作用、具体内容和实践操作中,依据步骤S3的分类结果,对每句话均进行分类,判断属于方法类或结构类,并在存储区中找到相同领域作用的方案作为相似方案。

4.根据权利要求3所述的数字经济领域基于语言逻辑学的文本特征检索方法,其特征在于:所述步骤S5中的比较方法,具体过程为:设置一个对比值,在相似方案中,统计词语数量,与识别区中的高频词语进行比值计算,当小于对比值时,停止该方案,进行下一个相似方案的比较,当大于对比值时,统计相似方案中的语句数量,得到相似语句的数量,相似语句数量与识别区的全部语句数量做比,得到重复度。