在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

對話三位IEEE專家:如何理解SAM視覺大模型

IEEE電氣電子工程師 ? 來源:IEEE電氣電子工程師 ? 2023-08-23 16:32 ? 次閱讀

正在流行的視覺AI大模型SAM究竟是一種什么樣的技術,會形成什么樣的產業影響?經濟觀察報就此采訪三位IEEE(電氣電子工程師學會)專家,解讀了視覺大模型SAM技術、應用路線以及對原有產業的影響。

今年4月,Meta公布了一款名為SAM(Segment Anything Model)的技術,這是一款用于圖像分割的AI大模型,會對圖像進行觀察、感知、思考、邏輯推理、得出結果,且操作極其簡單,類似于ChatGPT用人類語言對話的方式給機器下命令。

IEEE高級會員、天津理工大學教授、AR/VR技術專家羅訓對記者表示,SAM是視覺領域的通用大模型,很多報道中把它比喻成視覺領域的ChatG-PT,SAM和ChatGPT的支撐技術和應用場景都是不同的,但是在通用性這一點上,它們都是當前技術發展趨勢的代表者。

SAM技術、應用路線和顛覆性

作為AI的一個重要分支,機器視覺的目標是讓計算機模仿人類視覺系統,實現圖像和視頻的理解和處理。

IEEE數字化轉型聯合會策略與架構主席汪齊齊對記者表示,高效準確的圖像分割結果,對于日常生活和商業場景,甚至科研領域都具有重大意義。正因為如此,其在計算機視覺領域一直是個重要的課題。SAM的圖像分割功能,是機器視覺的核心任務之一。過去,機器視覺分割圖像的過程需要大量圖像標注、堆疊算法,消耗大量算力。如今,SAM更容易地實現了機器視覺的目標。

Meta將SAM大模型和背后數據集一并開源,相關的研究手稿也于今年4月5日發布在arXiv上(用于學術交流的預印本平臺),作者有Alexander Kirillov,Eric Mintun等12人。

此后,SAM在開源社區Github上獲得大量關注,一些華人學者又照此原理提出了相關的大模型GroundingDI-NO,用于物體檢測,不久GitHub上有人再創新,將GroundingDINO和SAM結合,達到了對圖像識別、檢測、分割的效果。

汪齊齊表示,該模型在準確程度、效率上,達到了驚人的提升。尤其是SAM開源的SA-1B數據庫,用巨量的圖像以及更加巨量的Mask(這里譯為圖層遮罩),將有助于許多科研項目和商業化項目在高起點上快速更新迭代,產生更好的模型和更優化的數據。

Meta從AR、VR、內容創建等領域,介紹了SAM的應用場景。中國的專家看到了更廣泛的應用場景。

羅訓對記者表示,鑒于計算機視覺的廣泛應用場景,SAM的發布對產業的影響也會是巨大的,會賦能更多的長尾創新者進入產業,并進一步豐富應用場景和商業模式。

汪齊齊表示,早前人工智能技術就能實現回答用戶問題的功能,而Chat-GPT第一次讓很多人產生了“生成的回復可以在接受的比例下用于日常、商用和科研”,并因此達到了在這個垂直領域前所未有的高度。目前SAM的分割結果,以及其公開的大量供公眾使用的資源來看,SAM在其擅長的垂直領域也達到了相當可觀的高度,并會從技術、數據以及對于這個領域的關注度等多方面幫助計算機視覺在短時間內產生大量突破,而計算機視覺,是一個非常重要的“廣義AI生態”中的基礎設施,該方面的突破將實現對數字化世界的理解和升級,帶來質變的效率和價值提升。

IEEE會士、河海大學信息科學與工程學院院長韓光潔對記者表示,SAM將會在自動駕駛、安防控制、醫學影像處理等應用領域改變業態布局,甚至引發技術革命。SAM作為一個基礎模型,可為這些應用領域快速孵化出適用性更強的專用網絡模型。

SAM的變革性可能會顛覆一批原有的AI技術優勢。汪齊齊表示,視覺大模型會在相當多的領域抵消技術壁壘,這在任何一次產業技術升級中都多次出現,也是無法避免的。

羅訓表示,通用大模型就相當于AI的能力開放平臺,之前頭部企業的AI能力優勢,會因為通用大模型的興起而被一定程度削弱。但是這些企業是否本身會變弱,取決于它們的轉型。

羅訓舉例稱,回顧移動計算在本世紀前十年的變化,iOS和安卓的能力開放平臺在賦能長尾創新者方面起到了非常重要的作用,極大增加了移動計算產業規模。在移動計算領域,WindowsMobile和塞班的封閉平臺最終因為缺乏競爭力而退出了市場。

汪齊齊表示,作為有核心技術儲備和深入理解的企業,首先是需要擁抱大模型,尤其是應該感謝相對公開的大模型,將自己對于產業的理解和領先部分,在大模型的加持下快速升級,演化出更新的形態。同時,計算機視覺領域也一定會有大模型目前還不擅長的領域,仍然可以作為技術壁壘,并在這些方面繼續深挖獨有優勢。

AIGC帶來知識和技術的平權?

此前有科技企業表示,AIGC的本質是技術平權和知識平權,這在很大程度上將大廠與小廠拉到了同一起跑線上。

羅訓就該觀點對記者表示,技術和知識平權的說法并不是很準確,因為之前并沒有系統性的歧視。AIGC帶來的是“易得”,本質上是市場規模急劇擴大后的成本降低。AIGC會促進整個社會對算力和計算模式使用的轉型升級,大規模提高AI使用者的生產效率,同時利好AI軟硬件設施生態企業。過程中,巨頭和大廠是技術進步的先期投入者,它們在其周期內獲取回報也是合理的,因為它們付出了更高的成本,也承擔了更大的風險。

汪齊齊認為,AIGC確實帶來了一定的技術平權,但技術本身是有一個價值屬性的。例如,曾經做網頁可以帶來不菲的收入,隨著工具升級和模板的完善,一個漂亮網頁制作難度數量級地下降,但是他帶來的價值也產生數量級地下降。

同樣,AIGC將一個需要大量技術和知識儲備才能產生優質內容的時代,帶入輕易產生的優質內容的時代,這會讓原有定義的“優質內容”的平均價值急速下降。

汪齊齊表示,AIGC是否帶來了知識平權仍然有待商榷。長期來看,AIGC可能會使人們更容易獲取到真實有用的知識。但是今天,人們還處于“技術帶來了前所未有的體量的知識,也同時讓篩選這些知識的可用度達到了前所未有的高成本”。

汪齊齊表示,盡管AIGC可以產生大量的知識和內容,但其準確性和可信度是個挑戰,相當部分AIGC是基于老的訓練數據,“一本正經供應錯誤知識”的案例已經有很多。目前在大量、無法辨別真偽的數據和內容的情況下,是否真正達到了知識平權,是要打問號的。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • SAM
    SAM
    +關注

    關注

    0

    文章

    114

    瀏覽量

    33841
  • ChatGPT
    +關注

    關注

    29

    文章

    1588

    瀏覽量

    8851
  • AIGC
    +關注

    關注

    1

    文章

    385

    瀏覽量

    2303
  • 大模型
    +關注

    關注

    2

    文章

    3058

    瀏覽量

    3888

原文標題:對話三位IEEE專家:如何理解SAM視覺大模型

文章出處:【微信號:IEEE_China,微信公眾號:IEEE電氣電子工程師】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏

    評論

    相關推薦
    熱點推薦

    基于MindSpeed MM玩轉Qwen2.5VL多模態理解模型

    多模態理解模型是讓AI像人類一樣,通過整合多維度信息(如視覺、語言、聽覺等),理解數據背后的語義、情感、邏輯或場景,從而完成推理、決策等任務。
    的頭像 發表于 04-18 09:30 ?848次閱讀
    基于MindSpeed MM玩轉Qwen2.5VL多模態<b class='flag-5'>理解</b><b class='flag-5'>模型</b>

    蔡司CIMT2025 | 新品天團第三位成員ZEISS ScanPort亮相 – 一鍵掃描,效率倍增!

    蔡司CIMT2025 | 新品天團第三位成員ZEISS ScanPort亮相 – 一鍵掃描,效率倍增! ? ? 蔡司新品組團出道 ? 您是否正在尋找一款 移動靈活的 自動化維光學掃描系統 為您提
    發表于 04-11 15:27 ?195次閱讀
    蔡司CIMT2025 | 新品天團第<b class='flag-5'>三位</b>成員ZEISS ScanPort亮相 – 一鍵掃描,效率倍增!

    ?VLM(視覺語言模型)?詳細解析

    視覺語言模型(Visual Language Model, VLM)是一種結合視覺(圖像/視頻)和語言(文本)處理能力的多模態人工智能模型,能夠理解
    的頭像 發表于 03-17 15:32 ?3162次閱讀
    ?VLM(<b class='flag-5'>視覺</b>語言<b class='flag-5'>模型</b>)?詳細解析

    RFID技術三位一體開啟智能資產管理新時代

    三位一體的RFID解決方案將RFID電子標簽、手持機和讀寫器有機結合,形成完整的資產管理閉環。RFID電子標簽作為數據載體,手持機提供移動采集能力,固定讀寫器實現自動化監控,者協同工作,構建起智能化的資產管理網絡。
    的頭像 發表于 02-21 11:29 ?322次閱讀
    RFID技術<b class='flag-5'>三位</b>一體開啟智能資產管理新時代

    一文詳解視覺語言模型

    視覺語言模型(VLM)是一種多模態、生成式 AI 模型,能夠理解和處理視頻、圖像和文本。
    的頭像 發表于 02-12 11:13 ?1586次閱讀
    一文詳解<b class='flag-5'>視覺</b>語言<b class='flag-5'>模型</b>

    【「大模型啟示錄」閱讀體驗】如何在客服領域應用大模型

    訓練模型如BERT、GPT等。這些模型理解自然語言、生成文本、處理對話等方面具有不同的能力。因此,在選擇模型時,需要了解每個
    發表于 12-17 16:53

    NaVILA:加州大學與英偉達聯合發布新型視覺語言模型

    (VLM)是一種具備多模態生成能力的先進AI模型。它能夠智能地處理文本、圖像以及視頻等多種提示,并通過復雜的推理過程,實現對這些信息的準確理解和應用。NaVILA正是基于這一原理,通過將大型語言模型(LLM)與
    的頭像 發表于 12-13 10:51 ?626次閱讀

    ADS1284數據采集時,只要24數據,是取高三位還是低三位

    ADS1284數據采集時,只要24數據,是取高三位還是低三位?高位是MSB,低位是LSB。
    發表于 11-29 08:21

    理解LLM中的模型量化

    今世界,人工智能和機器學習的應用已成為解決實際問題不可或缺的一部分。大型語言模型視覺模型因其卓越的表現和實用性而備受
    的頭像 發表于 10-25 11:26 ?641次閱讀
    <b class='flag-5'>理解</b>LLM中的<b class='flag-5'>模型</b>量化

    NVIDIA榮登《財富》“100家最適合工作的公司”榜單第三位

    NVIDIA 在《財富》雜志和卓越職場(Great Place to Work)最新評選出的“100 家最適合工作的公司”榜單上躍居第三位。
    的頭像 發表于 10-10 09:27 ?627次閱讀

    英偉達推出Eagle系列模型

    英偉達最新推出的Eagle系列模型,以其1024×1024像素的高分辨率處理能力,重新定義了視覺信息處理的邊界。該模型通過多專家視覺編碼器架
    的頭像 發表于 09-03 16:13 ?788次閱讀

    摩爾線程正式開源音頻理解模型MooER

    近日,國內領先的GPU創新企業摩爾線程宣布了一項重大技術突破——正式開源其自主研發的音頻理解模型MooER(摩耳)。這一舉動標志著我國在音頻處理與理解領域邁出了堅實的一步,特別是在基于國產硬件的AI
    的頭像 發表于 08-27 15:24 ?845次閱讀

    計算機視覺技術的AI算法模型

    計算機視覺技術作為人工智能領域的一個重要分支,旨在使計算機能夠像人類一樣理解和解釋圖像及視頻中的信息。為了實現這一目標,計算機視覺技術依賴于多種先進的AI算法模型。以下將詳細介紹幾種常
    的頭像 發表于 07-24 12:46 ?1666次閱讀

    三位半和四半萬用表的區別

    三位半和四半萬用表是電子測量領域中常用的兩種數字萬用表,它們在測量精度、顯示方式、應用范圍等方面存在一定的差異。本文將從多個方面詳細分析這兩種萬用表的區別。 一、基本概念 三位半萬用表 三位
    的頭像 發表于 07-14 14:23 ?9588次閱讀

    極化繼電器的三位置式的特點是什么

    極化繼電器是一種特殊類型的繼電器,它具有個位置:正常位置、極化位置和反極化位置。這種繼電器廣泛應用于電力系統、自動化控制、通信設備等領域。本文將詳細介紹極化繼電器的三位置式的特點,包括其工作原理
    的頭像 發表于 06-24 09:34 ?1039次閱讀
    主站蜘蛛池模板: 日韩三级中文字幕 | 狠狠色 综合色区 | 天天爽天天爽天天片a久久网 | 国产片无遮挡在线看床戏 | 四虎影院大全 | 人人草人人干 | 上海一级毛片 | 俄罗斯一级特黄黄大片 | 免费人成年激情视频在线观看 | h网站在线观看 | 在线观看亚洲专3333 | 成片免费的禁v影片 | 精品亚洲欧美无人区乱码 | 黄视频国产 | 一级特黄国产高清毛片97看片 | 久久久精品免费热线观看 | 亚洲xx网站 | 久久精品亚洲 | 亚洲成在人线影视天堂网 | 五月天精品 | 你懂的手机在线视频 | 免费观看做网站爱 | 欧美成人 一区二区三区 | 天天爽夜夜爽免费看 | 禁h粗大太大好爽好涨受不了了 | aaa在线观看高清免费 | 成人窝窝午夜看片 | 久久男人精品 | bt种子在线搜索 | 欧美精品成人久久网站 | 黄色福利小视频 | 欧美性free| 欧美成人免费草草影院 | 速度与激情10 | 天天碰免费视频 | 亚洲伊人精品综合在合线 | 性生交大片免费一级 | 国产成年女一区二区三区 | 喷潮白浆直流在线播放 | 美女被羞羞产奶视频网站 | 午夜视频在线观看国产 |