当前位置: 首页 > news >正文

三一重工的网站是哪家做的网络游戏推广

三一重工的网站是哪家做的,网络游戏推广,北京疫情最新风险点位,黄村网站建设费用基于论文摘要的文本分类与关键词抽取挑战赛​​​​​​2023 iFLYTEK A.I.开发者大赛-讯飞开放平台 环境需求:Anaconda-JupyterNotebook,或者百度AIStudio 赛题解析: 【文本二分类任务】根据论文摘要等信息理解,将论文划分为0-1两…

基于论文摘要的文本分类与关键词抽取挑战赛
​​​​​​2023 iFLYTEK A.I.开发者大赛-讯飞开放平台

环境需求:Anaconda-JupyterNotebook,或者百度AIStudio

赛题解析:

【文本二分类任务】根据论文摘要等信息理解,将论文划分为0-1两类别之一。
【文本关键词识别任务】从给定的论文中识别和提取出与论文内容相关的关键词。

数据样例:title、author、Abstract、Keywords、[label] 0-1

一键运行的时候先把csv删了(是运行结果)

安装nltk【更换镜像源避免安装出错】

!pip install nltk -i http://mirrors.aliyun.com/pypi/simple/  --trusted-host mirrors.aliyun.com
# 导入pandas用于读取表格数据
import pandas as pd# 导入BOW(词袋模型)
from sklearn.feature_extraction.text import CountVectorizer
#可以替换为TfidfVectorizer(TF-IDF(词频-逆文档频率))
#注意上下文要同时修改,亲测后者效果更佳# 导入LogisticRegression回归模型
from sklearn.linear_model import LogisticRegression# 过滤警告消息
from warnings import simplefilter
from sklearn.exceptions import ConvergenceWarning
simplefilter("ignore", category=ConvergenceWarning)# 读取数据集
train = pd.read_csv('/home/aistudio/data/data231041/train.csv')
train['title'] = train['title'].fillna('')
train['abstract'] = train['abstract'].fillna('')test = pd.read_csv('/home/aistudio/data/data231041/testB.csv')
test['title'] = test['title'].fillna('')
test['abstract'] = test['abstract'].fillna('')# 提取文本特征,生成训练集与测试集
train['text'] = train['title'].fillna('') + ' ' +  train['author'].fillna('') + ' ' + train['abstract'].fillna('')+ ' ' + train['Keywords'].fillna('')
test['text'] = test['title'].fillna('') + ' ' +  test['author'].fillna('') + ' ' + test['abstract'].fillna('')vector = CountVectorizer().fit(train['text'])
train_vector = vector.transform(train['text'])
test_vector = vector.transform(test['text'])# 引入模型
model = LogisticRegression()# 开始训练,这里可以考虑修改默认的batch_size与epoch来取得更好的效果
model.fit(train_vector, train['label'])# 利用模型对测试集label标签进行预测
test['label'] = model.predict(test_vector)
test['Keywords'] = test['title'].fillna('')
test[['uuid','Keywords','label']].to_csv('submit_task1.csv', index=None)

ndarray.finall()方法:填充空值

pandas数据处理常用命令_ndarray fillna_hellosc01的博客-CSDN博客

Basedline的方法:BOW词袋提取特征-LR逻辑回归-进行预测

改进方法:TF-IDF,SVM,epoches

# TfidfVectorizer(TF-IDF(词频-逆文档频率))
from sklearn.feature_extraction.text import TfidfVectorizer
# 导入支持向量机分类器
from sklearn.svm import SVC#创建SVM训练模型 
model = SVC(kernel='linear', C=1)# 利用模型对测试集label标签进行预测
test['label'] = model.predict(test_vector)
test['Keywords'] = test['title'].fillna('')
test[['uuid','Keywords','label']].to_csv('submit_task2.csv', index=None)

by ライト

http://www.khdw.cn/news/62423.html

相关文章:

  • 泰安个人代做网站网站快速排名服务商
  • 可以做围棋题的网站seo自动推广工具
  • 西安网站建设创意百度首页排名优化平台
  • 盐城网站开发公司电话杭州网站推广公司
  • 个人做网站 优帮云网站产品推广
  • 国外购物网站怎么做优化大师网页版
  • 实业 东莞网站建设东莞网站seo公司哪家大
  • 电商运营职业规划深圳网络优化公司
  • wordpress quora优秀网站seo报价
  • 做短视频的网站收益uc浏览器关键词排名优化
  • 云相册网站怎么做的google推广服务商
  • 微信开发者平台在哪里找吉林seo刷关键词排名优化
  • 网络服务商和网络运营商重庆网站排名优化教程
  • 圣沃建设集团官方网站seo优化排名方法
  • 网站开发 技术架构盐城seo培训
  • 太原网站设计郑州网络营销哪个好
  • 怎么做网站关键词yahoo搜索引擎提交入口
  • 选择网站建设系统百度一下你就知道官方
  • phpcms网站seo怎么做广告的六种广告形式
  • asp.net mvc 做网站户外广告
  • 深圳做互联网教网站公司网络平台
  • 如何做英文网站的外链西安竞价托管
  • 可以做多边形背景的网站外贸网站营销推广
  • 网站建设工资一月多少钱学做电商需要多少钱
  • 上海网站开发哪家好薇网推渠道
  • 门户网站建设与开发游戏推广公司好做吗
  • 做哪种网站浏览量比较高外贸seo网站
  • 如何做电商网站首页广告软文小故事200字
  • 太谷网站建设网络营销的主要传播渠道是
  • 用php做的企业网站作业品牌seo推广咨询