免费阅读
返回
菜单
上一章查看最新章节下一章

第十一章 女孩的心思

作品:台球博士作者:木森研心
如果本章错误,请点击报错10秒纠正

“好的,我是想计算一下行业内每两个公司之间的相似度……”

凌志听着客户的需求,也不时提出一些疑问。回答完之后根据数据量给出了一个报价以及预期交付时间,客户并没有多砍价,就这么敲定了。

实际上计算文本相似度的方法有很多,比如统计两个文本中有没有词语同时出现,出现频率是否相近,标点符号使用频率是否一致等等。但这些统计都是表层的统计,句子语义深层次的相似度没有办法通过这种办法来计算。比如“开心”和“快乐”是同一语义,相似度为0.97,而“开心”和“伤心”则是相反语义,相似度为0.02。如果用最表层的统计方法是没办法得出上述结论的。所以在当下,深度学习方法则成为主要的学习句子深层次语义的方法。

凌志并不想糊弄客户,他想既然要做那就尽量做到最好。虽然客户在这一块并不是专业的,也并不知道计算相似度都有哪些方法,更没有去问凌志打算如何计算,但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。

凌志看着客户发来的每个公司的代表产品,找到了之前自己训练好的一份词向量表,先把产品名用分词工具分词,再对应到词向量表中,最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算,最终一平均得到了每一对公司之间的相似度……

感觉也不复杂,但是不知不觉一天就过去了。凌志整理了一下数据,发给了客户。

“您好,相似度的计算已经搞好了,您看您还满意么?”

过了一会儿,客户回复道:

“[拱手]整理得太细致了,谢谢您。不过您是怎么计算相似度的呢?如果方便的话能不能告诉我一下,我想写进我的介绍推文里。”

“哦哦,其实也不复杂,我用的是词向量计算的,而词向量是用深度学习方法训练出来的……”

凌志仔细地打了一大段文字,大概介绍了一下原理,没有说得太细。实际上词向量的训练过程是深度神经网络根据词的上下文来推断出来的,比如说,“开心”这个词周围经常出现的词汇与“伤心”就截然不同。所以深度语义,本质上也是由他的上下文来决定的。这也是凌志大致解释给客户的内容。

至于如何根据上下文推导出词向量,上下文的范围界定到底有多广,凌志就没有细讲,讲了客户也不关心,他只会挑重点说。

“谢谢您哈,对了,其实我这边还有一大批数据需要计算相似度,您能不能

…。。
   本章没完,请点击下—页继续阅读!如果被转码了请退出转码或者更换浏揽器即可。
  温馨提示:亲爱的读者,如果你觉得本站还好,为了避免丢失和转马,请勿依赖搜索访问,建议你使用[华为刘揽器]或[Firefox火狐刘揽器]访问并收蔵【文坛书院】 m.1went.net。我们将会持续为你更新,还建议你注册会员使用书架功能追书阅读更方便。
上一页 1234下一页
上一章查看目录下一章
临时书架加入书签回顶部↑

看了《台球博士》的书友还喜欢看

万人迷美人训狗手册【快穿】
作者:藻蓝椰子
简介: 【多男主+沉浸式+苏爽撩】\n桑泠是个坏女人,天使的长相纯黑的心。

更新时间:2026-03-04 21:03:28
最新章节:第723章 堂姐重生回来抢我人生46
巫师:我有修仙长生系统
作者:陆鹿一
简介: 【修仙长生系统欢迎宿主使用】【当前坐标:凌云阁】墨菲扫视了一圈这个以圆木栅栏围起来的...
更新时间:2026-03-04 20:51:04
最新章节:第44章 传奇种子
矜娇厌厌
作者:不吃胡萝卜的兔老大
简介: 她是秦江珩娇养的花,消失三年后再见,本该人生有路各分东西,可却被他强搂进怀里。
更新时间:2026-03-04 21:13:54
最新章节:第95章 摩天轮
神魂丹帝
作者:浊酒一湖
简介: 少年十年坚持,却惨遭未婚妻夺取武魂而亡!穿越觉醒神秘武魂的秦朗,发誓绝不再让别人左右...
更新时间:2026-03-04 20:26:22
最新章节:第三千七百四十二章 邪异种族
芙莉莲:词条勇者的冒险旅行
作者:不能没肉
简介: “一件普通的亚麻衬衫,要500金币?”

“物超所值,我的朋...
更新时间:2026-03-04 21:05:00
最新章节:第85章 嗜血的诅咒(3/5 求首订)
柴刀流漫画大师
作者:神奇柠檬茶
简介: “哈?渣男?你们自愿的凭什么说我是渣男?”……坂本健重生东京,一周目,把现实当成恋爱...
更新时间:2026-03-04 20:33:31
最新章节:第273章 炎热夏日
书名:

本站若有图片广告属于第三方接入,非本站所为,广告内容与本站无关,不代表本站立场,请谨慎阅读。

Copyright © 2020 文坛书院 All Rights Reserved.kk

SiteMap