当前位置: 首页 > news >正文

做网站的时候卖过假货而出过事简述网络营销的主要方法

做网站的时候卖过假货而出过事,简述网络营销的主要方法,视频软件,wordpress多说头像1 前言 jieba 是一个非常流行的中文分词库,具有高效、准确分词的效果。 它支持3种分词模式: 精确模式全模式搜索引擎模式 jieba0.42.1测试环境:python3.10.9 2 三种模式 2.1 精确模式 适应场景:文本分析。 功能&#xff1…

1 前言

jieba 是一个非常流行的中文分词库,具有高效、准确分词的效果。

它支持3种分词模式:

  • 精确模式
  • 全模式
  • 搜索引擎模式
jieba==0.42.1

测试环境:python3.10.9

2 三种模式

2.1 精确模式

适应场景:文本分析。

功能:可以将句子精确的分开。

import jiebatext = "有勇气的牛排是一个编程领域博主的名字"
segments = jieba.lcut(text)print("精确模式分词结果:", segments)
# ['有', '勇气', '的', '牛排', '是', '一个', '编程', '领域', '博主', '的', '名字']

jieba分词 精确模式

2.2 全模式

适应场景:提取词语。

功能:可以将句子中的成词的词语扫描出来,速度非常快,但不能解决歧义问题。

import jiebatext = "有勇气的牛排是一个编程领域博主的名字"segments = jieba.lcut(text, cut_all=True)
print("全模式分词结果:", segments)
# ['有', '勇气', '的', '牛排', '是', '一个', '编程', '领域', '博', '主', '的', '名字']

jieba分词 全模式

2.3 搜索引擎模式

适应场景:搜索分词。

功能:在精确模式的基础上,对长分词进行切分,提高召回率。

import jiebatext = "有勇气的牛排是一个编程领域博主的名字"segments = jieba.lcut_for_search(text)
print("搜索引擎模式分词结果:", segments)

jieba分词 搜索引擎模式

3 自定义词典

jieba允许用户自定义词典,以提高分词的准确性。

比如专业术语、名字、网络新流行词汇、方言、以及其他不常见短语名字等。

3.1 添加单个词语

import jiebatext = "有勇气的牛排是一个编程领域博主的名字"jieba.add_word("有勇气的牛排")
segments = jieba.lcut_for_search(text)
print("搜索引擎模式分词结果:", segments)
# ['勇气', '牛排', '有勇气的牛排', '是', '一个', '编程', '领域', '博主', '的', '名字']

jieba分词添加单个词语

3.2 添加词典文件

cs_dict.txt

有勇气的牛排
编程领域

main.py

import jiebatext = "有勇气的牛排是一个编程领域博主的名字"jieba.load_userdict("cs_dict.txt")segments = jieba.lcut(text)
print("自定义词典文件分词结果:", segments)
# ['有勇气的牛排', '是', '一个', '编程领域', '博主', '的', '名字']

jieba自定义词典

4 词性标注

jieba 的词性标注(POS tagging)功能使用了标注词性(Part-of-Speech tags)来表示每个词的词性。

4.1 词性对照表

原文地址:https://www.couragesteak.com/article/454

a   形容词  			ad  副形词  
ag  形容词性语素  	  an  名形词  
b   区别词  			c   连词  
d   副词  			dg  副语素  
e   叹词  			f   方位词  
g   语素  			h   前缀  
i   成语  			j   简称略语  
k   后缀  			l   习用语  
m   数词  			mg  数语素  
mq  数量词  			n   名词  
ng  名语素  			nr  人名  
ns  地名  			nt  机构团体  
nz  其他专名  		   o   拟声词  
p   介词  			q   量词  
r   代词  			rg  代词性语素  
s   处所词  			t   时间词  
tg  时间词性语素  	  u   助词  
vg  动语素  			v   动词  
vd  副动词  			vn  名动词  
w   标点符号  			x   非语素字  
y   语气词  			z   状态词  

4.2 测试案例

import jieba.posseg as psegtext = "有勇气的牛排是一个编程领域博主的名字"words = pseg.cut(text)
for word, flag in words:print(f"{word} - {flag}")

jieba词性 案例

5 关键词提取

from jieba import analyse
text = "有勇气的牛排是一个编程领域博主的名字"# 取前5个关键词
keywords = analyse.extract_tags(text, topK=5)
print("关键词提取结果:", keywords)

jieba关键词提取

6 词频统计

import jieba
from collections import Counter
text = "有勇气的牛排是一个编程领域博主的名字"# 取前5个关键词
segments = jieba.lcut(text)
word_counts = Counter(segments)
print("词频统计结果:", word_counts)

jieba词频统计

http://www.khdw.cn/news/9213.html

相关文章:

  • 长沙门户网站轻松seo优化排名
  • 网站建设 主机选择山东网站seo推广优化价格
  • 建自己博客网站惠州seo关键字优化
  • 网站视频弹窗广告代码qq引流推广软件免费
  • 临淄网站建设多少钱网站关键词排名如何提升
  • asp.net做动态网站怎么做手机百度关键词优化
  • wordpress RSS怎么用株洲企业seo优化
  • 闲置电脑做网站服务器什么是seo优化?
  • 阿里云1核2g服务器能建设几个网站宁波好的seo外包公司
  • 自建网站步骤旅游最新资讯
  • 电商网站建设基础ppt域名批量查询
  • 十大房产网站排行榜竞价托管哪家公司好
  • 上海的外贸网站建设公司排名百度推广业务员电话
  • 商标号在线查询北京网站优化效果
  • 中国建设工程造价管理协会登录网站网页制作成品
  • 深圳罗湖网站制作手机免费发布信息平台
  • 网站空间不支持phpip域名查询地址
  • 高端网站建设哪家更专业设计模板网站
  • 石家庄网站制作机构广东疫情中高风险地区最新名单
  • 大型多媒体网站建设工具软文写作实训总结
  • 截获网站流量怎么做seo网站推广软件排名
  • 做新闻网站用什么程序seo图片优化
  • 动态网站开发技术 百度百科网站搜索引擎
  • 公司网页下载西安seo优化公司
  • 自己的网站如何让百度收录网络营销广告名词解释
  • 自己做采集电影网站超级外链
  • 医生做学分在哪个网站网络推广怎么学
  • 自己做的网站本地调试今天百度数据
  • 2017免费网站空间网络营销方法有哪些举例
  • 监控网站建设需要多少钱短视频培训学校