91在线观看视频-91在线观看视频-91在线观看免费视频-91在线观看免费-欧美第二页-欧美第1页

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫(xiě)文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

基于無(wú)監(jiān)督學(xué)習(xí)和圖學(xué)習(xí)的大數(shù)據(jù)挖掘

1ujk_Tencent_TE ? 來(lái)源:騰訊技術(shù)工程官方號(hào) ? 2019-12-08 10:57 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

在IJCAI-2019期間舉辦的騰訊TAIC晚宴和Booth Talk中,來(lái)自TEG數(shù)據(jù)平臺(tái)的張長(zhǎng)旺向大家介紹了自己所在用戶畫(huà)像組的前沿科研結(jié)果:

1. 非監(jiān)督短文本層級(jí)分類(lèi);

2. 大規(guī)模復(fù)雜網(wǎng)絡(luò)挖掘和圖表示學(xué)習(xí)。

其所在團(tuán)隊(duì)積極與學(xué)術(shù)界科研合作,并希望有夢(mèng)想、愛(ài)學(xué)習(xí)的實(shí)力派加入,共同研究和應(yīng)用半監(jiān)督/弱監(jiān)督/無(wú)監(jiān)督學(xué)習(xí)、小樣本學(xué)習(xí)、大規(guī)模復(fù)雜網(wǎng)絡(luò)挖掘和圖表示學(xué)習(xí)等做大數(shù)據(jù)挖掘。

科研結(jié)果1:非監(jiān)督短文本層級(jí)分類(lèi)

首先以下用戶和AI算法的對(duì)話,顯示了現(xiàn)實(shí)業(yè)務(wù)中使用現(xiàn)有監(jiān)督文本分類(lèi)算法的遇到的一些困境和問(wèn)題:

算法需要海量訓(xùn)練數(shù)據(jù)

算法模型用戶不可控

算法不能很好的適應(yīng)類(lèi)目的變化

我們分析現(xiàn)有監(jiān)督算法的主要問(wèn)題在于沒(méi)有真正的知識(shí), 沒(méi)有對(duì)于文本和類(lèi)目的真正的理解。現(xiàn)有算法只是在學(xué)習(xí)大量人工標(biāo)注訓(xùn)練樣本里面的模式。為了解決這個(gè)問(wèn)題,我們啟動(dòng)了一個(gè)叫做: 基于關(guān)鍵詞知識(shí)與類(lèi)目知識(shí)的非監(jiān)督短文本層級(jí)分類(lèi)的探索項(xiàng)目。

項(xiàng)目的主要思想是引入關(guān)鍵詞和類(lèi)目?jī)煞N知識(shí)來(lái)幫助算法理解關(guān)鍵詞和類(lèi)目的含義。然后基于知識(shí)進(jìn)行文本的分類(lèi)和標(biāo)注。關(guān)鍵詞知識(shí)主要來(lái)自3個(gè)方面包括:關(guān)鍵詞的網(wǎng)絡(luò)搜索上下文、關(guān)鍵詞的百科上下文、關(guān)鍵詞到類(lèi)目詞的后驗(yàn)關(guān)聯(lián)概率。我們提出類(lèi)目語(yǔ)義表達(dá)式來(lái)支持用戶表達(dá)豐富的類(lèi)目本身和類(lèi)目之間的關(guān)系的語(yǔ)義。這兩樣知識(shí)的引入幫助算法擺脫了對(duì)于大量人工標(biāo)注訓(xùn)練樣本的依賴,同時(shí)算法分類(lèi)的過(guò)程做到了人工可理解,人工可控制。

pIYBAF3sZiCAD0NcAAGXC_cWyhc920.jpg

基于關(guān)鍵詞和類(lèi)目知識(shí)的無(wú)監(jiān)督文本層級(jí)分類(lèi)算法流程如下:

對(duì)文本提取關(guān)鍵詞

根據(jù)關(guān)鍵詞知識(shí)計(jì)算關(guān)鍵詞到類(lèi)目詞的相關(guān)度詞向量

根據(jù)關(guān)鍵詞的相關(guān)度詞向量計(jì)算文本的相關(guān)度詞向量

根據(jù)文本的相關(guān)度詞向量和類(lèi)目語(yǔ)義表達(dá)式計(jì)算文本與每個(gè)類(lèi)目的匹配度

每個(gè)文本被分為與之匹配度最高的類(lèi)目

pIYBAF3sZiCAc4I1AAFF-PRpshM196.jpg

通過(guò)在兩個(gè)文本分類(lèi)數(shù)據(jù)集合上面的實(shí)驗(yàn),我們發(fā)現(xiàn),我們自研的算法能夠在沒(méi)有訓(xùn)練樣本的情況下提供質(zhì)量可用的結(jié)果,其一級(jí)類(lèi)目準(zhǔn)確率能夠達(dá)到80%,并且明顯高于現(xiàn)有其他非監(jiān)督算法。

pIYBAF3sZiCAPnfmAAGamuFnOPU555.jpg

科研結(jié)果2:大規(guī)模復(fù)雜網(wǎng)絡(luò)挖掘和圖表示學(xué)習(xí)

Network Representation Learning 或者說(shuō) Graph Embedding 是復(fù)雜網(wǎng)絡(luò)最新的研究課題,意在通過(guò)神經(jīng)網(wǎng)絡(luò)模型,把圖結(jié)構(gòu)向量化,為節(jié)點(diǎn)分類(lèi)、鏈路預(yù)測(cè)、社團(tuán)發(fā)現(xiàn)等挖掘任務(wù)提供方便有效的特征,以克服圖結(jié)構(gòu)難以應(yīng)用到機(jī)器學(xué)習(xí)算法中的難題。

本次我們?cè)贗JCAI發(fā)表的學(xué)術(shù)論文“Identifying Illicit Accounts in Large Scale E-payment Networks - A Graph Representation Learning Approach”創(chuàng)新性提出結(jié)合邊屬性的圖卷積神經(jīng)網(wǎng)絡(luò)模型,彌補(bǔ)了現(xiàn)有算法無(wú)法利用邊屬性為節(jié)點(diǎn)分類(lèi)提供更多信息的不足。

pIYBAF3sZiCAf4jWAADyry40GSc801.jpg

現(xiàn)有的圖學(xué)習(xí)算法,絕大部分都忽視了邊上信息的價(jià)值。在這里我們提出了一種可以把邊的信息傳輸?shù)焦?jié)點(diǎn)表示結(jié)果的改進(jìn)的GCN算法。算法主要思路是在做GCN里面周邊鄰居節(jié)點(diǎn)向量的聚合計(jì)算之前,把每個(gè)節(jié)點(diǎn)連接邊的Embedding向量拼接在對(duì)應(yīng)鄰居節(jié)點(diǎn)的Embedding向量后面。實(shí)驗(yàn)顯示,我們的算法對(duì)于金融分類(lèi)問(wèn)題具有更優(yōu)的結(jié)果。我們團(tuán)隊(duì)正在進(jìn)一步優(yōu)化模型,正在研發(fā)利用時(shí)序的GCN模型,以可以利用邊的時(shí)序交互信息,從而更好的表示動(dòng)態(tài)網(wǎng)絡(luò)。

pIYBAF3sZiGAcZ4XAAGfvV5Mbk0987.jpg

pIYBAF3sZiGAVDl_AAEtrHfo7Kk905.jpg

同時(shí),數(shù)平數(shù)據(jù)中心研發(fā)的Angel參數(shù)服務(wù)器平臺(tái),針對(duì)關(guān)系型數(shù)據(jù)結(jié)構(gòu),在計(jì)算性能上對(duì)圖算法做了優(yōu)化,極大加速了PageRank等算法的計(jì)算速度,比如計(jì)算用戶中心度的Closeness算法,性能比基于Spark GraphX的算法提升了6.7倍。下圖顯示對(duì)于大型圖的計(jì)算,我們Angle框架的速度具有明顯的優(yōu)勢(shì)。

pIYBAF3sZiGANHYUAAEl0_C2wBk224.jpg

pIYBAF3sZiGAXUHmAAEim4GgRxY047.jpg

我們所在團(tuán)隊(duì)積極與學(xué)術(shù)界科研合作,并希望有夢(mèng)想、愛(ài)學(xué)習(xí)的實(shí)力派加入,共同研究和應(yīng)用半監(jiān)督/弱監(jiān)督/無(wú)監(jiān)督學(xué)習(xí)、小樣本學(xué)習(xí)、復(fù)雜網(wǎng)絡(luò)挖掘和圖表示學(xué)習(xí)做大數(shù)據(jù)挖掘。

聲明:本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 算法
    +關(guān)注

    關(guān)注

    23

    文章

    4709

    瀏覽量

    95326
  • 大數(shù)據(jù)
    +關(guān)注

    關(guān)注

    64

    文章

    8959

    瀏覽量

    140134

原文標(biāo)題:IJCAI2019報(bào)告:基于無(wú)監(jiān)督學(xué)習(xí)和圖學(xué)習(xí)的大數(shù)據(jù)挖掘

文章出處:【微信號(hào):Tencent_TEG,微信公眾號(hào):騰訊技術(shù)工程官方號(hào)】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    任正非說(shuō) AI已經(jīng)確定是第四次工業(yè)革命 那么如何從容地加入進(jìn)來(lái)呢?

    的基本理論。了解監(jiān)督學(xué)習(xí)、無(wú)監(jiān)督學(xué)習(xí)和強(qiáng)化學(xué)習(xí)的基本原理。例如,在監(jiān)督學(xué)習(xí)中,理解如何通過(guò)標(biāo)注數(shù)據(jù)
    發(fā)表于 07-08 17:44

    機(jī)器學(xué)習(xí)異常檢測(cè)實(shí)戰(zhàn):用Isolation Forest快速構(gòu)建無(wú)標(biāo)簽異常檢測(cè)系統(tǒng)

    本文轉(zhuǎn)自:DeepHubIMBA無(wú)監(jiān)督異常檢測(cè)作為機(jī)器學(xué)習(xí)領(lǐng)域的重要分支,專門(mén)用于在缺乏標(biāo)記數(shù)據(jù)的環(huán)境中識(shí)別異常事件。本文深入探討異常檢測(cè)技術(shù)的理論基礎(chǔ)與實(shí)踐應(yīng)用,通過(guò)Isolatio
    的頭像 發(fā)表于 06-24 11:40 ?622次閱讀
    機(jī)器<b class='flag-5'>學(xué)習(xí)</b>異常檢測(cè)實(shí)戰(zhàn):用Isolation Forest快速構(gòu)建<b class='flag-5'>無(wú)</b>標(biāo)簽異常檢測(cè)系統(tǒng)

    使用MATLAB進(jìn)行無(wú)監(jiān)督學(xué)習(xí)

    無(wú)監(jiān)督學(xué)習(xí)是一種根據(jù)未標(biāo)注數(shù)據(jù)進(jìn)行推斷的機(jī)器學(xué)習(xí)方法。無(wú)監(jiān)督學(xué)習(xí)旨在識(shí)別
    的頭像 發(fā)表于 05-16 14:48 ?668次閱讀
    使用MATLAB進(jìn)行<b class='flag-5'>無(wú)</b><b class='flag-5'>監(jiān)督學(xué)習(xí)</b>

    大數(shù)據(jù)與云計(jì)算是干嘛的?

    大數(shù)據(jù)與云計(jì)算是支撐現(xiàn)代數(shù)字化技術(shù)的兩大核心。大數(shù)據(jù)專注于海量數(shù)據(jù)的采集、存儲(chǔ)、分析與價(jià)值挖掘;云計(jì)算通過(guò)虛擬化資源池提供彈性計(jì)算、存儲(chǔ)及服務(wù)能力。兩者結(jié)合,共同賦能企業(yè)決策、業(yè)務(wù)創(chuàng)新
    的頭像 發(fā)表于 02-20 14:48 ?612次閱讀

    什么是機(jī)器學(xué)習(xí)?通過(guò)機(jī)器學(xué)習(xí)方法能解決哪些問(wèn)題?

    計(jì)算機(jī)系統(tǒng)自身的性能”。事實(shí)上,由于“經(jīng)驗(yàn)”在計(jì)算機(jī)系統(tǒng)中主要以數(shù)據(jù)的形式存在,因此機(jī)器學(xué)習(xí)需要設(shè)法對(duì)數(shù)據(jù)進(jìn)行分析學(xué)習(xí),這就使得它逐漸成為智能數(shù)據(jù)
    的頭像 發(fā)表于 11-16 01:07 ?959次閱讀
    什么是機(jī)器<b class='flag-5'>學(xué)習(xí)</b>?通過(guò)機(jī)器<b class='flag-5'>學(xué)習(xí)</b>方法能解決哪些問(wèn)題?

    時(shí)空引導(dǎo)下的時(shí)間序列自監(jiān)督學(xué)習(xí)框架

    【導(dǎo)讀】最近,香港科技大學(xué)、上海AI Lab等多個(gè)組織聯(lián)合發(fā)布了一篇時(shí)間序列無(wú)監(jiān)督預(yù)訓(xùn)練的文章,相比原來(lái)的TS2Vec等時(shí)間序列表示學(xué)習(xí)工作,核心在于提出了將空間信息融入到預(yù)訓(xùn)練階段,即在預(yù)訓(xùn)練階段
    的頭像 發(fā)表于 11-15 11:41 ?760次閱讀
    時(shí)空引導(dǎo)下的時(shí)間序列自<b class='flag-5'>監(jiān)督學(xué)習(xí)</b>框架

    NPU與機(jī)器學(xué)習(xí)算法的關(guān)系

    在人工智能領(lǐng)域,機(jī)器學(xué)習(xí)算法是實(shí)現(xiàn)智能系統(tǒng)的核心。隨著數(shù)據(jù)量的激增和算法復(fù)雜度的提升,對(duì)計(jì)算資源的需求也在不斷增長(zhǎng)。NPU作為一種專門(mén)為深度學(xué)習(xí)等機(jī)器學(xué)習(xí)任務(wù)設(shè)計(jì)的處理器,其與機(jī)器
    的頭像 發(fā)表于 11-15 09:19 ?1205次閱讀

    如何使用 PyTorch 進(jìn)行強(qiáng)化學(xué)習(xí)

    的計(jì)算和自動(dòng)微分功能,非常適合實(shí)現(xiàn)復(fù)雜的強(qiáng)化學(xué)習(xí)算法。 1. 環(huán)境(Environment) 在強(qiáng)化學(xué)習(xí)中,環(huán)境是一個(gè)抽象的概念,它定義了智能體(agent)可以執(zhí)行的動(dòng)作(actions)、觀察到
    的頭像 發(fā)表于 11-05 17:34 ?1024次閱讀

    曙光公司成都云中心助力提升監(jiān)督質(zhì)效

    數(shù)字化時(shí)代,用好大數(shù)據(jù),推動(dòng)數(shù)字技術(shù)深度融入紀(jì)檢監(jiān)察各項(xiàng)業(yè)務(wù),是大勢(shì)所趨。當(dāng)前,各地正在探索推進(jìn)大數(shù)據(jù)監(jiān)督,借助海量數(shù)據(jù)、算力、算法,不斷延伸監(jiān)督
    的頭像 發(fā)表于 11-05 10:05 ?523次閱讀

    人工智能、機(jī)器學(xué)習(xí)和深度學(xué)習(xí)存在什么區(qū)別

    人工智能指的是在某種程度上顯示出類(lèi)似人類(lèi)智能的設(shè)備。AI有很多技術(shù),但其中一個(gè)很大的子集是機(jī)器學(xué)習(xí)——讓算法從數(shù)據(jù)學(xué)習(xí)
    發(fā)表于 10-24 17:22 ?2970次閱讀
    人工智能、機(jī)器<b class='flag-5'>學(xué)習(xí)</b>和深度<b class='flag-5'>學(xué)習(xí)</b>存在什么區(qū)別

    AI大模型與深度學(xué)習(xí)的關(guān)系

    人類(lèi)的學(xué)習(xí)過(guò)程,實(shí)現(xiàn)對(duì)復(fù)雜數(shù)據(jù)學(xué)習(xí)和識(shí)別。AI大模型則是指模型的參數(shù)數(shù)量巨大,需要龐大的計(jì)算資源來(lái)進(jìn)行訓(xùn)練和推理。深度學(xué)習(xí)算法為AI大模型提供了核心的技術(shù)支撐,使得大模型能夠更好地?cái)M
    的頭像 發(fā)表于 10-23 15:25 ?2874次閱讀

    基于Kepware的Hadoop大數(shù)據(jù)應(yīng)用構(gòu)建-提升數(shù)據(jù)價(jià)值利用效能

    處理超大數(shù)據(jù)集。 Hadoop的生態(tài)系統(tǒng)非常豐富,包括許多相關(guān)工具和技術(shù),如Hive、Pig、HBase等,這些工具可以方便地構(gòu)建復(fù)雜的大數(shù)據(jù)應(yīng)用。Hadoop廣泛應(yīng)用于各種場(chǎng)景,包括數(shù)據(jù)處理和分析、
    的頭像 發(fā)表于 10-08 15:12 ?346次閱讀
    基于Kepware的Hadoop<b class='flag-5'>大數(shù)據(jù)</b>應(yīng)用構(gòu)建-提升<b class='flag-5'>數(shù)據(jù)</b>價(jià)值利用效能

    基于大數(shù)據(jù)與深度學(xué)習(xí)的穿戴式運(yùn)動(dòng)心率算法

    性能的關(guān)鍵手段。然而,在復(fù)雜多變的運(yùn)動(dòng)環(huán)境中,準(zhǔn)確測(cè)量心率數(shù)據(jù)對(duì)于傳統(tǒng)算法而言具有較大的技術(shù)瓶頂。本文將探討如何運(yùn)用大數(shù)據(jù)和深度學(xué)習(xí)技術(shù)來(lái)開(kāi)發(fā)創(chuàng)新的穿戴式運(yùn)動(dòng)心率算
    的頭像 發(fā)表于 09-10 08:03 ?635次閱讀
    基于<b class='flag-5'>大數(shù)據(jù)</b>與深度<b class='flag-5'>學(xué)習(xí)</b>的穿戴式運(yùn)動(dòng)心率算法

    【《大語(yǔ)言模型應(yīng)用指南》閱讀體驗(yàn)】+ 基礎(chǔ)知識(shí)學(xué)習(xí)

    收集海量的文本數(shù)據(jù)作為訓(xùn)練材料。這些數(shù)據(jù)集不僅包括語(yǔ)法結(jié)構(gòu)的學(xué)習(xí),還包括對(duì)語(yǔ)言的深層次理解,如文化背景、語(yǔ)境含義和情感色彩等。 自監(jiān)督學(xué)習(xí):模型采用自
    發(fā)表于 08-02 11:03

    【《大語(yǔ)言模型應(yīng)用指南》閱讀體驗(yàn)】+ 基礎(chǔ)篇

    章節(jié)最后總結(jié)了機(jī)器學(xué)習(xí)的分類(lèi):有監(jiān)督學(xué)習(xí)無(wú)監(jiān)督學(xué)習(xí)、半監(jiān)督學(xué)習(xí)、自監(jiān)督學(xué)習(xí)和強(qiáng)化
    發(fā)表于 07-25 14:33
    主站蜘蛛池模板: 亚洲综合激情网 | 狠狠干网站 | 一本一本大道香蕉久在线精品 | 日韩高清一级 | 伊人欧美在线 | 免费看片你懂的 | 4虎影视国产在线观看精品 4虎影院永久地址www | 欧美四虎 | 欧美日韩你懂的 | 天天躁夜夜躁狠狠躁2021a | 丁香六月婷婷在线 | 黄色自拍偷拍 | 欧美一区精品 | 一本一本大道香蕉久在线精品 | 国产一区二区三区乱码 | 天天干夜夜躁 | 五月婷婷六月丁香激情 | 下农村女人一级毛片 | 日韩一级片在线免费观看 | 国内精品久久久久久久久蜜桃 | 福利社看片| 好吊色青青青国产在线观看 | 手机精品在线 | 综合久久99 | 国产玖玖| 91午夜在线观看 | 国产免费小视频 | 欧美资源在线观看 | 美女免费毛片 | 999久久精品国产 | 欧美18videosex性欧美1819 | brazzers在线| 男校霸把男校草玩出水男男 | 国产yw855.c免费视频 | 99久免费精品视频在线观看2 | 国产一区在线mmai | 久久婷五月综合 | 91大神大战高跟丝袜美女 | 天天干天天色天天干 | 日本午夜大片a在线观看 | 五月天毛片|