将本站设为首页
收藏生存官网,记住:www.sc5235.com
账号:
密码:

生存中文:看啥都有、更新最快

生存中文:www.sc5235.com

如果你觉得好,恳请收藏

您当前的位置:生存中文 -> 台球博士 -> 第十一章 女孩的心思

第十一章 女孩的心思

温馨提示:如果本章属于内容错误等情况,请点击下面的按钮发送报告,我们会在一分钟内纠正,谢谢

  “好的,我是想计算一下行业内每两个公司之间的相似度……”

凌志听着客户的需求,也不时提出一些疑问。回答完之后根据数据量给出了一个报价以及预期交付时间,客户并没有多砍价,就这么敲定了。

实际上计算文本相似度的方法有很多,比如统计两个文本中有没有词语同时出现,出现频率是否相近,标点符号使用频率是否一致等等。但这些统计都是表层的统计,句子语义深层次的相似度没有办法通过这种办法来计算。比如“开心”和“快乐”是同一语义,相似度为0.97,而“开心”和“伤心”则是相反语义,相似度为0.02。如果用最表层的统计方法是没办法得出上述结论的。所以在当下,深度学习方法则成为主要的学习句子深层次语义的方法。

凌志并不想糊弄客户,他想既然要做那就尽量做到最好。虽然客户在这一块并不是专业的,也并不知道计算相似度都有哪些方法,更没有去问凌志打算如何计算,但凌志依然想用深度学习方法来帮助客户准确计算每个公司的相似度。

凌志看着客户发来的每个公司的代表产品,找到了之前自己训练好的一份词向量表,先把产品名用分词工具分词,再对应到词向量表中,最终将两个公司之间的产品所对应的向量进行两两欧氏距离计算,最终一平均得到了每一对公司之间的相似度……

感觉也不复杂,但是不知不觉一天就过去了。凌志整理了一下数据,发给了客户。

“您好,相似度的计算已经搞好了,您看您还满意么?”

过了一会儿,客户回复道:

“[拱手]整理得太细致了,谢谢您。不过您是怎么计算相似度的呢?如果方便的话能不能告诉我一下,我想写进我的介绍推文里。”

“哦哦,其实也不复杂,我用的是词向量计算的,而词向量是用深度学习方法训练出来的……”

凌志仔细地打了一大段文字,大概介绍了一下原理,没有说得太细。实际上词向量的训练过程是深度神经网络根据词的上下文来推断出来的,比如说,“开心”这个词周围经常出现的词汇与“伤心”就截然不同。所以深度语义,本质上也是由他的上下文来决定的。这也是凌志大致解释给客户的内容。

至于如何根据上下文推导出词向量,上下文的范围界定到底有多广,凌志就没有细讲,讲了客户也不关心,他只会挑重点说。

“谢谢您哈,对了,其实我这边还有一大批数据需要计算相似度,您能不能


  本章未完,请点击下一页继续阅读!

看了《台球博士》的书友还喜欢看

系统赋我长生,我熬死了所有人
作者:一只榴莲3号
简介: 以生命之外的身份,去观察时间长河中修仙者的红尘情仇。从不算繁华的小镇中走出,踏入了精...
更新时间:2025-01-05 16:48:56
最新章节:第1246章 一碗饺子,再战一场!
校花的贴身医生
作者:吃蟑螂药的小强
简介: 我唐毅本想做个流氓,奈何医书精湛,身边美女如云,却没有时间共度春宵。
更新时间:2025-01-05 16:46:32
最新章节:第一百五十四章谈心
六年后,我携四个幼崽炸翻前夫家
作者:相思一顾
简介: 外界传言,南知意不孕不育,婆婆嫌弃,因此成为帝家弃妇。谁知六年后,她携崽回归,惊艳众...
更新时间:2025-01-05 15:29:47
最新章节:第1856章 我会守着你,深爱着你
穿书女频,大婚当日被女主杀死
作者:孤山放牛娃
简介: 【扮猪吃虎+杀伐果断+阴险狡诈+同级无敌】叶凌天穿越到一本女频权谋小说中,成为大周反...
更新时间:2025-01-05 15:43:07
最新章节:第998章 是谁杀了吾儿?
开局一座核心舱
作者:西贝猫
简介: 因为自己的粗心大意,端木槐穿越到了游戏《星海OL》的世界之中,从一个小小的核心舱开始...
更新时间:2025-01-05 16:32:00
最新章节:第一千六百七十章 不死好啊(燕云好像有点儿意思?)
从海贼开始横推万界
作者:燕云因陀罗
简介: 又名《海贼:老子是伊姆》又名《诸天万界世界政府》穿越海贼世界,重生伊姆大人,掌控世界...
更新时间:2025-01-05 15:15:00
最新章节:第一千八百八十七章 请辞的三笠和希丝特莉亚的电话!