当前位置: 首页 > news >正文

做网站做国外广告网络推广方案怎么写

做网站做国外广告,网络推广方案怎么写,住房和城乡建设部政务服务平台app,做网站公司需要什么职位本文利用20Newsgroup这个数据集作为Corpus(语料库),用户可以通过搜索关键字来进行查询关联度最高的News,实现对文本的搜索引擎: 1. 导入数据集 from sklearn.datasets import fetch_20newsgroupsnewsgroups fetch_20newsgroups()print(fNu…

本文利用20Newsgroup这个数据集作为Corpus(语料库),用户可以通过搜索关键字来进行查询关联度最高的News,实现对文本的搜索引擎:

1. 导入数据集

from sklearn.datasets import fetch_20newsgroupsnewsgroups = fetch_20newsgroups()print(f'Number of documents: {len(newsgroups.data)}')
print(f'Sample document:\n{newsgroups.data[0]}')

2. 向量化单词

from sklearn.feature_extraction.text import CountVectorizer
count = CountVectorizer()
count.fit(newsgroups.data)
show_vocabulary(count)print(f'Size of vocabulary: {len(count.get_feature_names_out())}')def show_vocabulary(vectorizer):words = vectorizer.get_feature_names_out()print(f'Vocabulary size: {len(words)} words')# we can print ~10 words per linefor l in np.array_split(words, math.ceil(len(words) / 10)):print(''.join([f'{x:<15}' for x in l]))

3. 搜索引擎

#将语料库进行转化
corpus_bow = count.transform(newsgroups.data)#提供用户输入,对输入内容进行转化为BoW - Bag of word
query = input("Type your query: ")
query_bow = count.transform([query])from sklearn.metrics.pairwise import cosine_similarity#比较输入内容与语料库中的相似度
similarity_matrix = cosine_similarity(corpus_bow, query_bow)
print(f'Similarity Matrix Shape: {similarity_matrix.shape}')

得到Similarity_matrix一共有N行,表示语料库中的文档数。还有一列,代表相似度系数。

第K行的相似度系数,代表用户输入的文本与语料库中第K个文档的相似程度。

我们对相似度矩阵进行排序:

similarities = pd.Series(similarity_matrix[:, 0])
similarities.head(10)

那么和用户输入最相关的文档就是第一个了!

print('Best document:')
print(newsgroups.data[top_10.index[0]])

结论:本文利用Cosine_similarity比较文档的相似度,从语料库找出最佳匹配的文档。

如果对单词的向量化,BoW概念有问题可以看下我的另一篇文章。

CSDN

下面一篇文章我会具体分析Cosine_similarity的原理,敬请关注!

http://www.hengruixuexiao.com/news/33795.html

相关文章:

  • 网站建设有哪些困难百度广告联盟点击一次多少钱
  • 做设计参考的网站seo课程培训入门
  • seo推广用什么做网站好seo网络推广培训
  • 聊天网站制作教程电商平台推广公司
  • 做免费网站网站销售怎么推广
  • 做网站怎么租个域名my63777免费域名查询2023年
  • c语言和c 哪个做网站好湖南专业seo推广
  • 甘肃永靖建设住建局网站如何建立一个网站
  • 网站 备案 哪个省百度竞价怎么做开户需要多少钱
  • 重庆seo霸屏正规seo排名外包
  • 天津网站建设公司推荐百度明星人气榜入口
  • 设计师网站推荐搜索引擎推广的优势
  • 网站建设网站服务百度seo一本通
  • 佛山新网站建设特色友情链接发布平台
  • 网站做美食视频挣钱吗如何做好一个营销方案
  • 做网站运营工作有前景吗苏州seo网站推广哪家好
  • 建微信网站模板seo诊断书案例
  • 网站调用微博最新国际新闻50条简短
  • 做wd网站实训报告总结信息流优化师怎么入行
  • 京东购物windows优化大师要会员
  • 建设网站企业百度经验官网入口
  • 成都网站建设商家本溪seo优化
  • wordpress iis建站谷歌浏览器搜索引擎入口
  • 黑龙江建设兵团知青网站推广神器
  • 建设400官方网站产品销售方案与营销策略
  • 昆明网站排名微营销软件
  • wordpress wp options惠州百度关键词优化
  • 提供网站制作公司地址线上营销模式
  • 网站开发科技公司南阳本地网络推广优化公司
  • 政府综合类门户网站建设方案南宁 百度网盘