<label id="jgr5k"></label>
    <legend id="jgr5k"><track id="jgr5k"></track></legend>

    <sub id="jgr5k"></sub>
  1. <u id="jgr5k"></u>
      久草国产视频,91资源总站,在线免费看AV,丁香婷婷社区,久久精品99久久久久久久久,色天使av,无码探花,香蕉av在线
      您正在使用IE低版瀏覽器,為了您的雷峰網(wǎng)賬號(hào)安全和更好的產(chǎn)品體驗(yàn),強(qiáng)烈建議使用更快更安全的瀏覽器
      此為臨時(shí)鏈接,僅用于文章預(yù)覽,將在時(shí)失效
      人工智能 正文
      發(fā)私信給張進(jìn)
      發(fā)送

      0

      商湯大模型的「5o」交互,普通人如何和 AI 過一天?

      本文作者: 張進(jìn) 2024-07-15 18:42
      導(dǎo)語:與真實(shí)世界的實(shí)時(shí)交互,是推動(dòng) AI 2.0 時(shí)代超級(jí)時(shí)刻和應(yīng)用爆發(fā)的一個(gè)核心。

      「雷峰網(wǎng)(公眾號(hào):雷峰網(wǎng))」在剛剛結(jié)束的堪稱「AI 界春晚」的世界人工智能大會(huì)(WAIC 2024)上,「中國(guó)版GPT-4o」亮相,它是來自商湯科技發(fā)布的“日日新5o”——國(guó)內(nèi)首個(gè)「流式交互」多模態(tài)大模型。

      在商湯的演示下,日日新5o擁有像人一樣的實(shí)時(shí)視覺能力,可以跟人進(jìn)行流暢的視頻交互——能聽、能說、能看、無延時(shí),它可以通過攝像頭+語音實(shí)現(xiàn)和用戶的實(shí)時(shí)交互,并獲知用戶所在的真實(shí)場(chǎng)景下的各種狀態(tài)信息,打破了與AI交互的次元壁,實(shí)現(xiàn)了與AI的“視頻通話”,已經(jīng)具備真人聊天般的交互體驗(yàn)。

      兩個(gè)月前OpenAI推出了GPT-4o,以突破性的智能交互能力,徹底顛覆了我們對(duì)AI語音助手的認(rèn)知,顛覆了過去的人機(jī)交互,給業(yè)界帶來又一次震撼。

      震撼之外,中國(guó)大模型界對(duì)GPT-4o的認(rèn)知似乎并不如GPT-4那么統(tǒng)一,有人認(rèn)為「在實(shí)現(xiàn)AGI的路上,GPT-4o并不重要」、有人評(píng)價(jià)「在技術(shù)突破上,GPT-4o沒那么驚艷」;有人認(rèn)為GPT-4o的發(fā)布是 AI 2.0 時(shí)代的標(biāo)志性事件,會(huì)催生全新的應(yīng)用平臺(tái)和商業(yè)模式。

      帶來的共識(shí)是,多模態(tài)可能引領(lǐng)新的交互模式和產(chǎn)品創(chuàng)新,多模態(tài)大模型開始成為國(guó)內(nèi)大模型競(jìng)爭(zhēng)的下一個(gè)焦點(diǎn)。

      然而,在國(guó)內(nèi)GPT-4o似乎并未成為引領(lǐng)多模態(tài)競(jìng)爭(zhēng)的產(chǎn)品形態(tài)時(shí),兩個(gè)月后商湯率先推出了「中國(guó)版GPT-4o」日日新5o大模型,商湯用行動(dòng)力證明了對(duì)GPT-4o的判斷。

      正如商湯 CEO 徐立在WAIC 2024上所講的:「行業(yè)要變化,交互模式一定是先行的」,解釋了商湯為什么要做「中國(guó)版GPT-4o」,首創(chuàng)流式交互大模型。

      1 大模型可以是每個(gè)人的貼身AI全能助手

      如果你擁有一個(gè)能看(現(xiàn)實(shí)世界)、能聽(讀懂指令)、能說(回答問題)的貼身 AI 助手,將會(huì)是一種什么體驗(yàn)?

      這位貼身助手,擁有豐富的多領(lǐng)域知識(shí),包括生活、學(xué)習(xí)、工作各方面的知識(shí),關(guān)鍵還能看懂現(xiàn)實(shí)世界——攝像頭就是它獲取現(xiàn)實(shí)世界影像的眼睛,而視覺觸及到的信息,它能立馬進(jìn)行分析、總結(jié),通過實(shí)時(shí)對(duì)話,像面對(duì)面聊天一樣,立即告訴你問題的答案,沒有延遲和拒絕。

      早上起來,準(zhǔn)備出門,你想知道現(xiàn)在外面的天氣應(yīng)該做哪些準(zhǔn)備,日日新5o可以準(zhǔn)確地描述出外面的天氣狀況,并給出外出準(zhǔn)備的建議:

      走到一處很美的地方,你想拍照,但是不知道用什么姿勢(shì)拍出來好看,日日新5o開始充當(dāng)一個(gè)攝影助手,它會(huì)指導(dǎo)你如何根據(jù)當(dāng)前景色擺姿勢(shì)動(dòng)作、注意光線等等技巧:

      晚飯是一頓燒烤,大家一起搭起炭火爐、燃起炭火準(zhǔn)備燒烤,日日新5o能準(zhǔn)確地知道視頻里的人們正在干嘛,而且還能告訴詳細(xì)的戶外燒烤注意事項(xiàng):

      你想知道每種食材分別要如何燒烤才好吃,此時(shí)日日新5o化身為一名擁有多年烹飪經(jīng)驗(yàn)的燒烤大師,它能分辨出每種食材、要如何烤:

      回到酒店,你看到一袋咖啡,詢問日日新5o后它能識(shí)別出這是咖啡粉而不是速溶咖啡,并告訴你咖啡粉對(duì)應(yīng)的沖泡步驟,宛如一個(gè)咖啡師:

      日日新5o不僅擁有大量、多領(lǐng)域的生活方面的知識(shí),在日常生活場(chǎng)景中分別充當(dāng)了發(fā)型助手、攝影師、燒烤大師、咖啡師……在職場(chǎng)工作環(huán)境中,也是一把好手,比如能迅速地總結(jié)出這本書該頁講了什么知識(shí)。比人的反應(yīng)、分析、總結(jié)速度快多了:

      面對(duì)一張手寫的字條或詩句,它也能立馬回答出它的意思和出處:

      還能根據(jù)前三個(gè)字,準(zhǔn)確預(yù)測(cè)出整個(gè)成語是什么:

      從以上可以看到,日日新5o具備非常豐富的多領(lǐng)域知識(shí),相比其他AI助手,它能看、能聽、能讀,首創(chuàng)的實(shí)時(shí)流式交互方式,使其具備真人般的交流對(duì)話;能精準(zhǔn)地分析、辨別、總結(jié)出所「看到」的環(huán)境信息,在我們的生活、學(xué)習(xí)、工作中可以扮演多種助手角色,完全可以充當(dāng)一款 AI 全能助手。

      2 重塑交互的意義

      日日新5o能作為一款表現(xiàn)出色的 AI 全能助手,除了展示出了它對(duì)標(biāo)GPT-4o的各種能力:能看到那個(gè)現(xiàn)實(shí)世界,包括人、物、文字等符號(hào);能聽懂用戶的話語,并根據(jù)其中的指令對(duì)現(xiàn)實(shí)世界進(jìn)行識(shí)別,再反饋給用戶;能看書識(shí)字,概括總結(jié)所講的內(nèi)容……

      最大的變革就是交互模式的變化:國(guó)內(nèi)首個(gè)流式交互多模態(tài)大模型。商湯將流式交互融入到大模型中,給用戶帶來真人般的交流體驗(yàn),讓日日新5o系統(tǒng)更像人。

      我們知道,在人工智能發(fā)展中,ChatGPT之所一炮而紅,便是因?yàn)樗_始展露出人類所具備的自主學(xué)習(xí)、分析、總結(jié)能力以及邏輯能力,而讓大模型像人一樣交流,正如引言所說,交互模式先行似乎并不是業(yè)界共識(shí)。

      而商湯的日日新5o的發(fā)布,正是符合商湯對(duì)AI 2.0時(shí)代的判斷,正如CEO徐立所說:行業(yè)要變化,交互模式一定是先行的。

      在徐立看來,變化是指能定義AI 2.0時(shí)代的「超級(jí)時(shí)刻」,正如iPhone時(shí)刻定義了移動(dòng)互聯(lián)網(wǎng)的變化。而超級(jí)時(shí)刻需要一個(gè)超級(jí)應(yīng)用,即便是像ChatGPT、Sora都還沒有到超級(jí)時(shí)刻,是因?yàn)樗鼈儧]有真正走進(jìn)到一個(gè)行業(yè)的垂直應(yīng)用中、引起廣泛變化。

      走向應(yīng)用,商湯認(rèn)為需要有幾個(gè)核心的重點(diǎn)突破:

      第一個(gè)就是實(shí)時(shí)的交互性能帶來流暢的用戶體驗(yàn),這是推動(dòng)超級(jí)時(shí)刻以及應(yīng)用爆發(fā)的一個(gè)核心。

      第二是構(gòu)建高階思維邏輯的合成數(shù)據(jù),來提升模型的智力。

      最后,不管是文本、圖像、視頻,如果對(duì)它沒有可控性,那么它們作為一個(gè)工具,本身帶來的效能提升就非常有限。

      大模型本質(zhì)上是做記憶的事情,記住世界的知識(shí),就能回答的更準(zhǔn)確,在徐立看來,它僅有的一點(diǎn)智力來自于對(duì)知識(shí)背后的高階的思維邏輯的記憶,所以,在垂直行業(yè)里面怎么構(gòu)造高階思維邏輯的合成數(shù)據(jù),往往是制勝的關(guān)鍵,并且是差異化的關(guān)鍵,也是中國(guó)人工智能之路的關(guān)鍵。

      商湯最新發(fā)布的日日新5.5基座模型,便用了大量的合成、高階思維鏈的數(shù)據(jù),把模型能力平均提升了30%。

      商湯大模型的「5o」交互,普通人如何和 AI 過一天?

      商湯CEO徐立認(rèn)為,如果要推動(dòng)人工智能超級(jí)時(shí)刻的到來,需要大模型可以展現(xiàn)出卓越的深度思考的能力。那么合成的人工數(shù)據(jù),特別是高階思維的數(shù)據(jù)往往是非常重要的。所以越是有應(yīng)用的場(chǎng)景,才能形成更好的高質(zhì)量的數(shù)據(jù)的一些核心。

      過去垂直領(lǐng)域是依賴人去構(gòu)建更加高級(jí)的思維鏈數(shù)據(jù),但是商湯認(rèn)為,往前一步,不應(yīng)該依賴人,而是應(yīng)該通過跟真實(shí)世界的交互形成執(zhí)行數(shù)據(jù),去做推理。

      因此,基于基座模型日日新5.5,商湯研發(fā)了日日新5o流式交互多模態(tài)大模型,在攝像頭不停地移動(dòng)過程中、跟真實(shí)世界互動(dòng)獲取更多新的信息,去進(jìn)行推理、再得出反饋。

      日日新5o的各種功能離不開基座模型日日新5.5的支撐。今年4月發(fā)布的日日新5.0是國(guó)內(nèi)首個(gè)對(duì)標(biāo)GPT-4 Turbo的大模型,經(jīng)過兩個(gè)多月技術(shù)迭代,日日新5.5實(shí)現(xiàn)了多項(xiàng)功能升級(jí),在數(shù)學(xué)推理、英文能力、指令跟隨等能力上明顯增強(qiáng),交互效果和多項(xiàng)核心指標(biāo)可比肩GPT-4o。

      徐立認(rèn)為,如果能把這種流式交互多模態(tài)大模型置入眼鏡、手機(jī)、電腦等端側(cè)設(shè)備,可能會(huì)推動(dòng)一些應(yīng)用的爆發(fā)。


      雷峰網(wǎng)原創(chuàng)文章,未經(jīng)授權(quán)禁止轉(zhuǎn)載。詳情見轉(zhuǎn)載須知

      商湯大模型的「5o」交互,普通人如何和 AI 過一天?

      分享:
      相關(guān)文章
      最新文章
      請(qǐng)?zhí)顚懮暾?qǐng)人資料
      姓名
      電話
      郵箱
      微信號(hào)
      作品鏈接
      個(gè)人簡(jiǎn)介
      為了您的賬戶安全,請(qǐng)驗(yàn)證郵箱
      您的郵箱還未驗(yàn)證,完成可獲20積分喲!
      請(qǐng)驗(yàn)證您的郵箱
      立即驗(yàn)證
      完善賬號(hào)信息
      您的賬號(hào)已經(jīng)綁定,現(xiàn)在您可以設(shè)置密碼以方便用郵箱登錄
      立即設(shè)置 以后再說
      主站蜘蛛池模板: 中国毛片网| 亚洲中文字幕在线第六区| 久久人人妻人人爽人人卡片av | 国产在线你懂| 项城市| 人妖系列在线精品视频| 天堂人妻熟妇一区二区不卡| 国产精品成人一区二区三区视频| 日韩av爽爽爽久久久久久| 色姑娘综合网| 日韩一区日韩二区日韩三区| 熟妇人妻无码中文字幕老熟妇| 欧洲精品码一区二区三区| 四库影院永久国产精品| 日韩一区二区三区三级| 多p在线观看| 色二区| 国产精品一起草在线观看| 国产在线一区二区不卡| 国产午夜福利片在线观看| 亚洲精品无码国产片| www插插插无码免费视频网站| 综合无码| 日本中文字幕久久网站| 日韩黄片毛片在线观看| 亚洲制服另类无码专区| 老少配BBw性少配老| 国产乱子伦一区二区三区四区五区| 亚洲国产另类精品| 插入中文字幕在线一区二区三区| 老熟妇老熟女老女人天堂| 亚洲色五月| 午夜av高清在线观看| 狠狠躁18三区二区一区| 女人的天堂A国产在线观看| 精品国产免费一区二区三区香蕉| 咸阳市| 久久人人爽人人爽人人片| 每日更新AV| 天天做天天爱夜夜爽毛片| 国产免费va|