12月1日,阿里云舉辦通義千問發(fā)布會,開源通義千問720億參數(shù)模型Qwen-72B。Qwen-72B在10個權(quán)威基準測評創(chuàng)下開源模型最優(yōu)成績,成為業(yè)界最強開源大模型,性能超越開源標桿Llama 2-70B和大部分商用閉源模型。未來,企業(yè)級、科研級的高性能應用,也有了開源大模型這一選項。
通義千問還開源了18億參數(shù)模型Qwen-1.8B和音頻大模型Qwen-Audio。至此,通義千問共開源18億、70億、140億、720億參數(shù)的4款大語言模型,以及視覺理解、音頻理解兩款多模態(tài)大模型,實現(xiàn)“全尺寸、全模態(tài)”開源。力度之大,業(yè)界無出其右。
業(yè)界最強開源模型,填補中國LLM開源領(lǐng)域空白
Qwen-72B基于3T tokens高質(zhì)量數(shù)據(jù)訓練,延續(xù)通義千問預訓練模型一貫以來的強勢表現(xiàn),在10個權(quán)威基準測評中奪得開源模型最優(yōu)成績,在部分測評中超越閉源的GPT-3.5和GPT-4。
英語任務上,Qwen-72B在MMLU基準測試取得開源模型最高分;中文任務上,Qwen-72B霸榜C-Eval、CMMLU、GaokaoBench等基準,得分超越GPT-4;數(shù)學推理方面,Qwen-72B在GSM8K、MATH測評中斷層式領(lǐng)先其他開源模型;代碼理解方面,Qwen-72B在HumanEval、MBPP等測評中的表現(xiàn)大幅提升,代碼能力有了質(zhì)的飛躍。
在10大權(quán)威測評中,通義千問720億參數(shù)模型獲得開源模型最優(yōu)成績
通義千問720億開源模型部分成績超越閉源的GPT-3.5和GPT-4
Qwen-72B可以處理最多32k的長文本輸入,在長文本理解測試集LEval上取得了超越ChatGPT-3.5-16k的效果。研發(fā)團隊優(yōu)化了Qwen-72B的指令遵循、工具使用等技能,使之能更好地被下游應用集成。比如,Qwen-72B搭載了強大的系統(tǒng)指令(System Prompt)能力,用戶只用一句提示詞就可定制AI助手,要求大模型扮演某個角色或者執(zhí)行特定的回復任務。
用戶僅用一句提示詞就可創(chuàng)建自己的AI助手
此前,中國大模型市場還沒出現(xiàn)足以對標Llama 2-70B的優(yōu)質(zhì)開源模型。Qwen-72B填補了國內(nèi)空白,以高性能、高可控、高性價比的優(yōu)勢,提供不亞于商業(yè)閉源大模型的選擇。基于Qwen-72B,大中型企業(yè)可開發(fā)商業(yè)應用,高校、科研院所可開展AI for Science等科研工作。
從1.8B到72B, 通義千問 率先實現(xiàn)全尺寸開源
如果說Qwen-72B“向上摸高”,抬升了開源大模型的尺寸和性能天花板;發(fā)布會上的另一開源模型Qwen-1.8B則“向下探底”,成為尺寸最小的中國開源大模型,推理2K長度文本內(nèi)容僅需3G顯存,可在消費級終端部署。
從18億、70億、140億到720億參數(shù)規(guī)模,通義千問成為業(yè)界首個“全尺寸開源”的大模型。用戶可在魔搭社區(qū)直接體驗Qwen系列模型效果,也可通過阿里云靈積平臺調(diào)用模型API,或基于阿里云百煉平臺定制大模型應用。阿里云人工智能平臺PAI針對通義千問全系列模型進行深度適配,推出了輕量級微調(diào)、全參數(shù)微調(diào)、分布式訓練、離線推理驗證、在線服務部署等服務。
阿里云是國內(nèi)最早開源自研大模型的科技企業(yè),8月以來開源了Qwen-7B、Qwen-14B和視覺理解模型Qwen-VL。幾款模型先后沖上HuggingFace、Github大模型榜單,得到中小企業(yè)和個人開發(fā)者的青睞,累計下載量超過150萬,催生出150多款新模型、新應用。發(fā)布會現(xiàn)場,多位開發(fā)者伙伴現(xiàn)身說法,分享了他們用Qwen開發(fā)專屬模型和特定應用的實踐。
阿里云CTO周靖人表示,開源生態(tài)對促進中國大模型的技術(shù)進步與應用落地至關(guān)重要,通義千問將持續(xù)投入開源,希望成為“AI時代最開放的大模型”,與伙伴們共同促進大模型生態(tài)建設(shè)。
通義千問基座模型持續(xù)進化,多模態(tài)探索業(yè)界領(lǐng)先
通義千問在多模態(tài)大模型領(lǐng)域的探索也領(lǐng)先業(yè)界一步,當天,阿里云首次開源音頻理解大模型Qwen-Audio。
Qwen-Audio能夠感知和理解人聲、自然聲、動物聲、音樂聲等各類語音信號。用戶可以輸入一段音頻,要求模型給出對音頻的理解,甚至基于音頻進行文學創(chuàng)作、邏輯推理、故事續(xù)寫等等。音頻理解能夠賦予大模型接近人類的聽覺能力。
通義大模型能“聽”也能“看”。通義千問8月開源出視覺理解大模型Qwen-VL,迅速成為國際開源社區(qū)最佳實踐之一。本次發(fā)布會又宣布了Qwen-VL的重大更新,大幅提升通用OCR、視覺推理、中文文本理解基礎(chǔ)能力,還能處理各種分辨率和規(guī)格的圖像,甚至能“看圖做題”。不論從權(quán)威測評成績還是真人體驗的效果看,Qwen-VL的中文文本理解能力都大幅超越了GPT-4V。
通義千問閉源模型也在持續(xù)進化,一個月前發(fā)布的通義千問2.0版閉源模型,最近已進階至2.1版,上下文窗口長度擴展到32k,代碼理解生成能力、數(shù)學推理能力、中英文百科知識、幻覺誘導抵抗能力分別提升30%、10%、近5%和14%。用戶可以在通義千問APP免費體驗最新版本的閉源模型。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!
12月1日,首屆“通義千問AI挑戰(zhàn)賽”開賽,參賽者可免費暢玩通義開源模型家族,包括剛剛發(fā)布的720億參數(shù)模型Qwen-72B。主辦方為參賽者提供價值50萬元的免費云上算力和豐厚獎金。賽事分為算法和Agent兩大賽道,前者聚焦通義千問大模型的微調(diào)訓練,希望通過高質(zhì)量的數(shù)據(jù)探索開源模型的代碼能力上限,后
12月1日通義千問發(fā)布會,阿里云開源通義千問720億參數(shù)模型Qwen-72B。Qwen-72B在10個權(quán)威基準測評創(chuàng)下開源模型最優(yōu)成績,成為業(yè)界最強開源大模型,性能超越開源標桿Llama2-70B和大部分商用閉源模型,可適配企業(yè)級、科研級的高性能應用。通義千問當天還開源了18億參數(shù)模型Qwen-1.
這年頭,安卓廠商沒個大模型,都不敢開手機發(fā)布會了。前腳OPPO剛用大模型升級了語音助手,后腳vivo就官宣自研手機AI大模型;小米發(fā)布會則直接將大模型當場塞進手機系統(tǒng)……其競爭激烈程度,不亞于搶芯片首發(fā)。到底是怎么回事?究其原因,還是智能終端已經(jīng)成為了各類AIGC應用的落地“新灘頭”。先是圖像生成大
基于容聯(lián)云自主研發(fā)的赤兔大模型能力,容聯(lián)云容犀機器人真正將大模型強大的理解能力、知識學習能力、總結(jié)能力、挖掘能力、推理能力融入于實際落地應用中。開創(chuàng)性的打造生成式場景化智能問答、生成式智能輔助、AI運營話術(shù)庫,幫助企業(yè)洞悉更精準的客戶真實需求,提升一線客服人員的專業(yè)服務能力,并代替人工完成大量低價值
文:向善財經(jīng)關(guān)于百度,最近發(fā)生了這么兩件事兒。一個是華爾街分析師重申了對百度股票的買入評級和目標價,但在該公司11月21日公布第三季度收益之前下調(diào)了第三季度收入預期。分析師給出的理由是,線下廣告支出走軟,以及2G資金減少之后,給智能交通帶來挑戰(zhàn)。另外一個是最近文心一言正式上線了專業(yè)版,并且開始收費,
百度AI團隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術(shù)為核心,徹底重構(gòu)復雜文檔處理邊界。此次升級標志著OCR領(lǐng)域首次實現(xiàn)對同一文檔內(nèi)任意混合語言文本的精準識別,為全球化企業(yè)、跨境業(yè)務及多元文化場
“宇樹已形成硬件、算法、場景聯(lián)動的業(yè)務飛輪,自研率超95%的技術(shù)壁壘讓其成為全球機器人賽道不可忽視的中國力量?!笔壮藤Y本管理合伙人朱方文在追加投資時如是評價。7月7日,據(jù)每日經(jīng)濟新聞從宇樹科技投資方處獲悉,國內(nèi)人形機器人領(lǐng)軍企業(yè)宇樹科技(UnitreeRobotics)已明確計劃于科創(chuàng)板IPO,預計
推理與多模態(tài)的終極融合,將徹底終結(jié)用戶在不同模型間切換的煩惱。7月7日,OpenAI正式確認將在今年夏季推出新一代人工智能模型GPT-5。這一突破性產(chǎn)品將整合現(xiàn)有的多個強大模型,特別是融合專注推理能力的“O系列”與具備多模態(tài)功能的“GPT系列”,為用戶提供前所未有的統(tǒng)一體驗。OpenAI開發(fā)者體驗負
高考一結(jié)束,忙壞了海內(nèi)外一眾大模型。豆包、DeepSeek、ChatGPT、元寶、文心一言、通義千問……掀起了一波“AI趕考”大戰(zhàn)。據(jù)悉,去年高考期間,大模型的成績才勉強過一本線,今年集體晉升985。據(jù)悉,豆包甚至過了清北的錄取線。頭部大模型在高考“考場”上玩得不亦樂乎,中小AI創(chuàng)企的處境卻日益尷尬
文/二風來源/節(jié)點財經(jīng)每年高考成績放榜后,數(shù)千萬考生和家長將迎來另一場硬仗——填報志愿。今年,這一領(lǐng)域迎來了AI的全面介入,多家互聯(lián)網(wǎng)大廠和教育公司紛紛推出智能志愿填報產(chǎn)品,為考生提供院校和專業(yè)選擇建議。據(jù)艾媒咨詢數(shù)據(jù),2023年中國高考志愿填報市場付費規(guī)模約9.5億元,近九成考生愿意借助志愿填報服
蘋果還沒從WWDC25的“群嘲”中走出,又迎來了一次新的痛擊。據(jù)路透社報道,21日,蘋果公司遭到股東集體起訴,被指在信息披露中低估了將先進生成式AI整合進語音助手Siri所需的時間,導致iPhone銷量受影響、股價下滑,構(gòu)成證券欺詐。在這份訴訟中,庫克、首席財務官凱文·帕雷克及前首席財務官盧卡·馬埃
華為的盤古大模型終于推出新版本了。6月20日華為云計算CEO張平安宣布基于CloudMatrix384超節(jié)點的新一代昇騰AI云服務全面上線,盤古大模型5.5同步發(fā)布。不過,當前國內(nèi)的AI大模型競爭可謂是相當激烈,華為的盤古大模型在眾多大模型中并不是十分出眾。華為云此次重磅推出的盤古大模型5.5能否從
一場沒有羅永浩的“羅永浩直播”,正在改寫帶貨規(guī)則當數(shù)字人羅永浩在百度直播間舉起青島啤酒,以標志性幽默回應粉絲提問時,彈幕瘋狂刷出“這是真的還是假的?”的疑問。這場持續(xù)近7小時的直播,創(chuàng)下1300萬人次觀看、GMV突破5500萬元的驚人戰(zhàn)績,甚至超過了他本人一個月前真人直播5000萬元的成績。數(shù)字人主
高頻互動、個性化教學、突破成本壁壘,AI老師讓英語學習更普惠。6月24日,新東方正式推出面向消費者的首款原創(chuàng)AI教育產(chǎn)品——“新東方AI1對1”。這款產(chǎn)品標志著新東方在教育+AI戰(zhàn)略布局中邁出關(guān)鍵一步,旨在以科技力量推動優(yōu)質(zhì)教育資源的普惠發(fā)展。在發(fā)布會現(xiàn)場,新東方教育科技集團CEO周成剛表示:“AI
大家好,我是白楊SEO,專注SEO十年以上,全網(wǎng)SEO流量實戰(zhàn)派,AI搜索優(yōu)化研究者。為什么想分享這個AI工作流及coze扣子這個?因為我們搞流量的如果學會了用AI給我們生產(chǎn)提效將更有助于我們?nèi)カ@客。目前白楊SEO用得并不是很好,分享僅供參考,希望給你一些啟發(fā)。老規(guī)矩,先說下文章大綱如下:1、AI工