維基大典 zh_classicalwiki https://zh-classical.wikipedia.org/wiki/%E7%B6%AD%E5%9F%BA%E5%A4%A7%E5%85%B8:%E5%8D%B7%E9%A6%96 MediaWiki 1.47.0-wmf.14 first-letter 媒體 特殊 討論 用戶 用戶討論 維基大典 維基大典討論 檔案 檔案討論 MediaWiki MediaWiki討論 模板 模板討論 說明 說明討論 分類 分類討論 稿 酌稿 TimedText TimedText talk 模組 模組討論 Event Event talk 用戶:TongcyDai 2 83438 444220 342728 2026-08-06T15:21:58Z TongcyDai 66906 置為「陳說未周,博考備於[[wikt:zh:User:TongcyDai|詞典]];倘蒙下顧,僕亦在焉。」 444220 wikitext text/x-wiki 陳說未周,博考備於[[wikt:zh:User:TongcyDai|詞典]];倘蒙下顧,僕亦在焉。 m1azdk28jgis3fwgs831fp035rvoll1 言談生成預訓變狀器 0 112602 444235 430362 2026-08-06T18:48:40Z Oct431925 120775 444235 wikitext text/x-wiki {{非漢字不入題|ChatGPT}} [[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]] '''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式]]也,可與人對談,[[開放人工智能]]{{按|OpenAI}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。 此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[程序]]、助決策,不一而足。 [[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]] 西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。 時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。 == 版 == 各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref> {| class="wikitable" !版 !期 !述 !狀 |- |知彼他三半{{按|GPT-3.5}} |二〇二二年十一月 |初版,本於三點五之術。 |廢 |- |知彼他三半特補{{按|GPT-3.5 Turbo}} |[[二〇二三年]] |較前版稍精,然猶出同源。 |廢 |- |知彼他四{{按|GPT-4}} |二〇二三年三月 |「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。 |行 |- |知彼他四奧{{按|GPT-4o}} |[[二〇二四年]]五月 |其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。 |行 |- |知彼他四奧渺厘{{按|GPT-4o mini}} |二〇二四年七月 |纖巧於四奧,價廉而捷,多以代三半。 |行 |- |奧一預視{{按|o1-preview}} |二〇二四年九月 |奧一之先覽版。 |行 |- |奧一渺厘{{按|o1-mini}} |二〇二四年九月 |以輕捷見長。 |行 |} ==據== {{Reflist}} [[分類:人工智能]] s77gdlyzocrqz6j8bj6l6t09zy3lmjj 444236 444235 2026-08-06T18:50:07Z Oct431925 120775 444236 wikitext text/x-wiki {{非漢字不入題|ChatGPT}} [[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]] '''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式|電腦程序]]也,可與人對談,[[開放人工智能]]{{按|OpenAI}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。 此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[電腦程式|程序]]、助決策,不一而足。 [[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]] 西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。 時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。 == 版 == 各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref> {| class="wikitable" !版 !期 !述 !狀 |- |知彼他三半{{按|GPT-3.5}} |二〇二二年十一月 |初版,本於三點五之術。 |廢 |- |知彼他三半特補{{按|GPT-3.5 Turbo}} |[[二〇二三年]] |較前版稍精,然猶出同源。 |廢 |- |知彼他四{{按|GPT-4}} |二〇二三年三月 |「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。 |行 |- |知彼他四奧{{按|GPT-4o}} |[[二〇二四年]]五月 |其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。 |行 |- |知彼他四奧渺厘{{按|GPT-4o mini}} |二〇二四年七月 |纖巧於四奧,價廉而捷,多以代三半。 |行 |- |奧一預視{{按|o1-preview}} |二〇二四年九月 |奧一之先覽版。 |行 |- |奧一渺厘{{按|o1-mini}} |二〇二四年九月 |以輕捷見長。 |行 |} ==據== {{Reflist}} [[分類:人工智能]] 3sh3jkg6p679lvqyb0m3ba5o50a6pqo 444237 444236 2026-08-06T18:52:33Z Oct431925 120775 444237 wikitext text/x-wiki {{非漢字不入題|ChatGPT}} [[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]] '''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式|電腦程序]]也,可與人對談,{{tsl|zh|OpenAI|開放人工智能}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。 此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[電腦程式|程序]]、助決策,不一而足。 [[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]] 西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。 時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。 == 版 == 各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref> {| class="wikitable" !版 !期 !述 !狀 |- |知彼他三半{{按|GPT-3.5}} |二〇二二年十一月 |初版,本於三點五之術。 |廢 |- |知彼他三半特補{{按|GPT-3.5 Turbo}} |[[二〇二三年]] |較前版稍精,然猶出同源。 |廢 |- |知彼他四{{按|GPT-4}} |二〇二三年三月 |「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。 |行 |- |知彼他四奧{{按|GPT-4o}} |[[二〇二四年]]五月 |其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。 |行 |- |知彼他四奧渺厘{{按|GPT-4o mini}} |二〇二四年七月 |纖巧於四奧,價廉而捷,多以代三半。 |行 |- |奧一預視{{按|o1-preview}} |二〇二四年九月 |奧一之先覽版。 |行 |- |奧一渺厘{{按|o1-mini}} |二〇二四年九月 |以輕捷見長。 |行 |} ==據== {{Reflist}} [[分類:人工智能]] 6vonj8m5j5qnt2cd786t6psmeeg6yr3 大語言模型 0 124594 444241 420786 2026-08-06T19:14:34Z Oct431925 120775 444241 wikitext text/x-wiki '''大語言模型''',語言模型之長也,基於[[深度學習]]之術。集海量文辭,納古今中外之言,融彙百家,煉成一身。可作文賦詩,解疑答惑,譯諸國之言<ref name=":1">{{Cite web |last=Ouyang |first=Long |date=2022-03-02 |title=Training language models to follow instructions with human feedback |url=https://arxiv.org/abs/2203.02155 |access-date= 2024-10-21 |website=Arxiv |language=en-US |url-status=live}}</ref>。 蓋模型之所以大,因其參數衆多,動輒數十億乃至千億,內存浩瀚如海,包羅萬象。其訓練源材,涵蓋[[經]][[史]][[子]][[集]]、[[詩]][[詩餘|詞]]歌賦、[[小説]][[戲曲]]、[[論文]]報告、網絡文摘,乃至居處之對話,無所不有。經年纍月,吸納衆長,漸成一家之言<ref name=":2">{{Cite web |last=Team |first=GLM |date=2024-06-18 |title=ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools |url=https://arxiv.org/abs/2406.12793 |access-date= 2024-10-21 |website=Arxiv |language=en-US |url-status=live}}</ref>。 然模型亦有不足之處,其所習皆爲舊聞,難以時新,故於時事變遷或有未逮。且模型之言,蓋爲模式匹配,淺不足與測深。 於大語言模型所施之咒,謂之[[提示詞]]。 ==據== {{Reflist}} [[分類:人工智能]] 6mi8li36oldmv839fsvlrykyvmg70q0 用戶討論:Renamed user 15b4028f8b5ebfe957c699a5102b52b3 3 129245 444246 440629 2026-08-07T10:55:20Z MdsShakil 88892 MdsShakil已移動頁面[[用戶討論:Cachydesu]]至[[用戶討論:Renamed user 15b4028f8b5ebfe957c699a5102b52b3]],不留重新導向:當重新命名使用者「[[Special:CentralAuth/Cachydesu|Cachydesu]]」至「[[Special:CentralAuth/Renamed user 15b4028f8b5ebfe957c699a5102b52b3|Renamed user 15b4028f8b5ebfe957c699a5102b52b3]]」時自動移動頁面 420129 wikitext text/x-wiki {{Template:Welcome|realName=|name=Cakyyy}} -- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二五年七月三一日 (四) 〇八時四五分 (UTC) 7dlxoqvazt3gavtrawjykzmcq9js7dj 用戶討論:Renamed user 8c85e8421c2c47b8c3c94754483fb41a 3 129933 444247 422456 2026-08-07T10:55:33Z Superpes15 85491 Superpes15已移動頁面[[用戶討論:Hoaivu2005]]至[[用戶討論:Renamed user 8c85e8421c2c47b8c3c94754483fb41a]],不留重新導向:當重新命名使用者「[[Special:CentralAuth/Hoaivu2005|Hoaivu2005]]」至「[[Special:CentralAuth/Renamed user 8c85e8421c2c47b8c3c94754483fb41a|Renamed user 8c85e8421c2c47b8c3c94754483fb41a]]」時自動移動頁面 422456 wikitext text/x-wiki {{Template:Welcome|realName=|name=Hoaivu2005}} -- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二五年九月三日 (三) 一三時三四分 (UTC) 4bho3aqt09f010jdouufo1g00jimq40 信陽饑饉 0 132375 444245 427863 2026-08-07T10:39:01Z 一室幽蘭 105415 粗體 444245 wikitext text/x-wiki 西元[[一九五九年]]十月至明年四月,{{Pn|[[河南省]]|'''[[信陽專區]]}}大饑''',人相食,死者十一二。 == 歷 == 西元[[一九五七年]],{{Pn|[[毛澤東]]}}籲[[大躍進]],詐欺之風遂盛,謂畝產萬斤稻者有之。外官詐奏穀數,或倍於實情。五九年,徵糧,循去年之額,計一千三百五十億斤。七月,{{Pn|毛澤東}}斥{{Pn|[[彭德懷]]}}於{{Pn|廬山}},上下皆畏,層層相逼。雖歉收,強徵如故,不惜酷刑。 八月,{{Pn|河南省}}黨委書記{{Pn|[[吳芝圃]]}}還自{{Pn|廬山}},下傳東風。故吏不徵者治,民不捐者刑而毀其屋。是年饑饉,{{Pn|河南}}產糧二百一十億斤,芝圃估以四百五十億。 {{Pn|信陽專區}}實產二十億,諸縣衙咸詐告,彙得七十二億。區衙官{{Pn|張樹藩}}以爲三十億,見懲。卒區衙告行省以五十億,省令徵九億。威民以甲兵,竟徵十六億,至於種粒,又拘萬餘人。 秋,直徵糧於田壟。人皆謂豐年,萬戶無餘糧。嚴冬未屆,道有凍死骨。{{pn|[[光山縣|光山]]}}有醫,餓者求之,對曰食粥可愈,因是獲罪。故民諱言飢,浮腫者衆,飾以染疫,人死亦然。十月,公竈皆斷炊,餓殍暴於野。或棄嬰,拘父母。或私爨,破其釜。或殺牛,拘食牛者。人相食,拘食人者。人亡,設卒守道隘,截而拘亡者。或傳信,截信而拘書者。 時,{{Pn|信陽}}倉廩豐實,存糧十一億斤,皆懼,莫敢賑也。惟初九月{{Pn|樹藩}}賑於{{Pn|[[遂平]]}},旋見幽。民莫劫倉,惟數人踞門外,時時呼曰:「{{Pn|共產黨}}乎!{{Pn|毛主席}}乎!救我矣!」或忽斃焉。 明年二月,事發。朝使使視之,問{{Pn|樹藩}}曰:「餓斃者有諸?」對曰:「多之。」又問:「幾何?」對曰:「不知也,或二十餘萬。」驚而回稟。朝查之,謂斃者百有五萬人。{{Pn|信陽}}本八百有八萬人,死者十一二。 [[分類:中華人民共和國紀事]] 82njvy3rkeg2u0qpu7iisy05l5x1ego 用戶:Oct431925/深度求索 2 138660 444221 2026-08-06T17:30:28Z Oct431925 120775 新文「1」 444221 wikitext text/x-wiki 1 68m9lfln2dgvzieyrm8vqqf8ha8550r 444223 444221 2026-08-06T17:44:50Z Oct431925 120775 444223 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化创首梁文锋等肇建于癸卯年。专研通仝之基大语言模型,并开放其权,享誉于世。 == 历史 == === 深度求索-V3 === 深度求索-V3,西历二零二四年十二月面世,并开源之巨擘语言模型。总参六千七百一十亿,每用则活三百七十亿。预训于十四万八千亿词元,尤擅算学、汉文,力敌GPT-4o、Claude-3.5-Sonnet之流。费二千余H800图形卡,历五十六日,糜金五百五十七万美金。吐属之速,每秒六十词元,初容十二万八千词元,后拓至百万。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西历二零二五年元月面世。专以强化学励,于算学、编码、推演诸端,可抗OpenAI o1。同月廿七日,登苹果中美商肆榜首,美区下载冠绝ChatGPT。竞技场得一千三百五十七分,微胜o1。训费仅二十九万四千美金。模型及权柄悉依MIT协约公开,复蒸馏六小模以惠众。其论文尝登《自然》封面,为大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西历二零二六年四月发布,分Pro、Flash二品。 Pro品:总参一万六千亿,活者四百九十亿,为至强之选。于智能体、博物、推演诸能,皆冠开源,用感胜Claude Sonnet 4.5,近Opus 4.6。 Flash品:总参二千八百四十亿,活者一百三十亿,务求廉速。推演之能近Pro,而用度约当其三分一。每百万词元入者费零一四美分,出者零二八美分,行费约当GPT-5.6 Sol六十之一。 二品皆本容百万词元,创“词元缩注心”之法,算力显存大省。西历二零二六年七月,复推“推测解词”之术,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> mxsljmmbwa8zg2zp76mqq9ygiwql74q 444224 444223 2026-08-06T17:46:17Z Oct431925 120775 444224 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文檔 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> 0fko1lwpo8r8mkb7mfcql3zn7u9o75w 444226 444224 2026-08-06T17:47:53Z Oct431925 120775 已完成 444226 wikitext text/x-wiki #redirect [[深度求索]] awur6w2ydfx424huanhhs3eharhfu3s 用戶討論:Oct431925 3 138661 444222 2026-08-06T17:30:29Z New user message 64015 在新使用者的討論頁上添加[[Template:Welcome|歡迎資訊]] 444222 wikitext text/x-wiki {{Template:Welcome|realName=|name=Oct431925}} -- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二六年八月六日 (四) 一七時三〇分 (UTC) 7n30ho67b3r7gowvuw7k3o3zuunczxb 深度求索 0 138662 444225 2026-08-06T17:47:24Z Oct431925 120775 新文「深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十……」 444225 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文檔 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == <references/> c8y97s9lwbvl6zbi9r3bxyqzy2wtvfw 444227 444225 2026-08-06T17:49:31Z Oct431925 120775 444227 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文檔 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] 6i1ewqbmjnutp978ue50wl420wvwkzi 444228 444227 2026-08-06T17:50:29Z Oct431925 120775 444228 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] 6tefmgq39vu3zn18jij8sev2n78hzyv 444229 444228 2026-08-06T17:50:46Z Oct431925 120775 444229 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] jkkbtgm67nufzieh2u1aunxcryrihz2 444230 444229 2026-08-06T17:55:02Z Oct431925 120775 444230 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] k9y5dtbplsuesbcjao7xd3h20o58el9 444231 444230 2026-08-06T18:32:52Z Oct431925 120775 444231 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮維注心」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] p62lnn8cy7tu0p0wrpj3r8icjmme9te 444232 444231 2026-08-06T18:37:30Z Oct431925 120775 444232 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] 81qnszmbgbemdmafh8x56knyo7kil6b 444233 444232 2026-08-06T18:46:37Z Oct431925 120775 444233 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] 6lltu50eh4wmlgykzxvelojkbm0yopn 444234 444233 2026-08-06T18:47:34Z Oct431925 120775 /* 深度求索-R1 */ 444234 wikitext text/x-wiki 深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕[[ChatGPT]]。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] 5k6csutby8ttpunst8n06ns58avrwgu 444244 444234 2026-08-07T10:27:04Z 一室幽蘭 105415 粗體 444244 wikitext text/x-wiki '''深度求索''',杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web | title = DeepSeek-V3 Technical Report | url = https://arxiv.org/abs/2412.19437 | website = arXiv | date = 2024-12-25 | accessdate = 2026-08-07 }}</ref> === 深度求索-R1 === 深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕[[ChatGPT]]。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web | title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning | url = https://arxiv.org/abs/2501.12948 | website = arXiv | date = 2025-01-22 | accessdate = 2026-08-07 }}</ref> === 深度求索-V4 === 深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。 Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。 Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。 二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web | title = DeepSeek-V4 预览版:迈入百万上下文普惠时代 | url = https://api-docs.deepseek.com/zh-cn/news/news260424/ | website = DeepSeek API 文档 | date = 2026-04-24 | accessdate = 2026-08-07 }}</ref> == 考據 == {{Reflist}} [[分類:人工智能]] ti7sv256tfezren5h6h4uhguip09pxp DeepSeek 0 138663 444238 2026-08-06T18:55:26Z Oct431925 120775 渡至[[深度求索]] 444238 wikitext text/x-wiki #redirect [[深度求索]] awur6w2ydfx424huanhhs3eharhfu3s 提示詞 0 138664 444239 2026-08-06T19:12:26Z Oct431925 120775 新文「夫'''提示詞'''者,人之於大語言模型所施之咒也。善為者,可發號精準,令仝協理萬務。 模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]]」 444239 wikitext text/x-wiki 夫'''提示詞'''者,人之於大語言模型所施之咒也。善為者,可發號精準,令仝協理萬務。 模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]] kgqxu8j9c7ly4iaxwjnt9rgx85xp2im 444240 444239 2026-08-06T19:13:25Z Oct431925 120775 444240 wikitext text/x-wiki 夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。 模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]] qnf2gbu8bpahukvhl7us2rxi4smjrlx 444242 444240 2026-08-06T19:15:05Z Oct431925 120775 444242 wikitext text/x-wiki 夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。 模型內蘊之定式,謂之系統提示詞{{按|system prompt}}。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]] qrmumhkqiug3oz5dkzuzlv4ct8092ga 444243 444242 2026-08-06T19:15:19Z Oct431925 120775 444243 wikitext text/x-wiki 夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。 模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]] qnf2gbu8bpahukvhl7us2rxi4smjrlx