維基大典
zh_classicalwiki
https://zh-classical.wikipedia.org/wiki/%E7%B6%AD%E5%9F%BA%E5%A4%A7%E5%85%B8:%E5%8D%B7%E9%A6%96
MediaWiki 1.47.0-wmf.14
first-letter
媒體
特殊
討論
用戶
用戶討論
維基大典
維基大典討論
檔案
檔案討論
MediaWiki
MediaWiki討論
模板
模板討論
說明
說明討論
分類
分類討論
門
議
稿
酌稿
TimedText
TimedText talk
模組
模組討論
Event
Event talk
用戶:TongcyDai
2
83438
444220
342728
2026-08-06T15:21:58Z
TongcyDai
66906
置為「陳說未周,博考備於[[wikt:zh:User:TongcyDai|詞典]];倘蒙下顧,僕亦在焉。」
444220
wikitext
text/x-wiki
陳說未周,博考備於[[wikt:zh:User:TongcyDai|詞典]];倘蒙下顧,僕亦在焉。
m1azdk28jgis3fwgs831fp035rvoll1
言談生成預訓變狀器
0
112602
444235
430362
2026-08-06T18:48:40Z
Oct431925
120775
444235
wikitext
text/x-wiki
{{非漢字不入題|ChatGPT}}
[[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]]
'''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式]]也,可與人對談,[[開放人工智能]]{{按|OpenAI}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。
此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[程序]]、助決策,不一而足。
[[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]]
西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。
時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。
== 版 ==
各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref>
{| class="wikitable"
!版
!期
!述
!狀
|-
|知彼他三半{{按|GPT-3.5}}
|二〇二二年十一月
|初版,本於三點五之術。
|廢
|-
|知彼他三半特補{{按|GPT-3.5 Turbo}}
|[[二〇二三年]]
|較前版稍精,然猶出同源。
|廢
|-
|知彼他四{{按|GPT-4}}
|二〇二三年三月
|「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。
|行
|-
|知彼他四奧{{按|GPT-4o}}
|[[二〇二四年]]五月
|其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。
|行
|-
|知彼他四奧渺厘{{按|GPT-4o mini}}
|二〇二四年七月
|纖巧於四奧,價廉而捷,多以代三半。
|行
|-
|奧一預視{{按|o1-preview}}
|二〇二四年九月
|奧一之先覽版。
|行
|-
|奧一渺厘{{按|o1-mini}}
|二〇二四年九月
|以輕捷見長。
|行
|}
==據==
{{Reflist}}
[[分類:人工智能]]
s77gdlyzocrqz6j8bj6l6t09zy3lmjj
444236
444235
2026-08-06T18:50:07Z
Oct431925
120775
444236
wikitext
text/x-wiki
{{非漢字不入題|ChatGPT}}
[[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]]
'''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式|電腦程序]]也,可與人對談,[[開放人工智能]]{{按|OpenAI}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。
此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[電腦程式|程序]]、助決策,不一而足。
[[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]]
西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。
時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。
== 版 ==
各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref>
{| class="wikitable"
!版
!期
!述
!狀
|-
|知彼他三半{{按|GPT-3.5}}
|二〇二二年十一月
|初版,本於三點五之術。
|廢
|-
|知彼他三半特補{{按|GPT-3.5 Turbo}}
|[[二〇二三年]]
|較前版稍精,然猶出同源。
|廢
|-
|知彼他四{{按|GPT-4}}
|二〇二三年三月
|「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。
|行
|-
|知彼他四奧{{按|GPT-4o}}
|[[二〇二四年]]五月
|其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。
|行
|-
|知彼他四奧渺厘{{按|GPT-4o mini}}
|二〇二四年七月
|纖巧於四奧,價廉而捷,多以代三半。
|行
|-
|奧一預視{{按|o1-preview}}
|二〇二四年九月
|奧一之先覽版。
|行
|-
|奧一渺厘{{按|o1-mini}}
|二〇二四年九月
|以輕捷見長。
|行
|}
==據==
{{Reflist}}
[[分類:人工智能]]
3sh3jkg6p679lvqyb0m3ba5o50a6pqo
444237
444236
2026-08-06T18:52:33Z
Oct431925
120775
444237
wikitext
text/x-wiki
{{非漢字不入題|ChatGPT}}
[[檔案:ChatGPT-Logo.svg|縮圖|50px|徽]]
'''言談生成預訓變狀器'''{{按|ChatGPT}} <ref name=":4">{{Cite web |last=Roose |first=Kevin |date=2022-12-05 |title=The Brilliance and Weirdness of ChatGPT |url=https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |access-date= 2022-12-26 |website=The New York Times |language=en-US |archive-date=2023-01-18 |archive-url=https://web.archive.org/web/20230118134332/https://www.nytimes.com/2022/12/05/technology/chatgpt-ai-twitter.html |url-status=live}}</ref>,[[電腦程式|電腦程序]]也,可與人對談,{{tsl|zh|OpenAI|開放人工智能}}創之。知彼他{{按|GPT}}三半版、四版、四奧版、四半版、五版為本,[[大語言模型|大語言]]築基,以[[深度學習|深靈之術]]塑成。
此物類屬[[人工智能]],語料殊鉅,算法高明,年來因勢利導,發展迅猛,學識淵博,對答如流,無異真人。專事創作,如諷[[詩]]文、擬書郵、撰文稿、綴[[電腦程式|程序]]、助決策,不一而足。
[[File:ChatGPT_availability_by_country_or_region.svg|thumb|夫言談生成預訓變狀器,問世以來,寰宇諸處,可用之者幾何{{legend|#346733|可使用之}}{{legend|#e0e0e0|弗能用焉}}]]
西元[[二〇二二年]]十一月卅日問世。公世五日,用者凡百萬;未及二月,其眾逾億。
時至今日,其三半者雖存,然主用於其網驛者,四奧{{按|4o}}版。夫四奧之版,常人可無償而用之,亦可附以圖文檔案。然其用有度,問答過亟則暫歇以俟。
== 版 ==
各版見於下表,述其變革改易:<ref>{{Cite web |title=ChatGPT Release - Note |url=https://help.openai.com/en/articles/6825453-chatgpt-release-notes |website=OpenAI |access-date=February 8, 2023 |archive-date=March 23, 2023 |archive-url=https://web.archive.org/web/20230323004420/https://help.openai.com/en/articles/6825453-chatgpt-release-notes |url-status=live }}</ref><ref>{{Cite web |last=Achille |first=Belelli |title=ChatGPT Come Funziona |url=https://www.finanzadigitale.com/guide/chatgpt-come-funziona/ |website=FinanzaDigitale}}</ref>
{| class="wikitable"
!版
!期
!述
!狀
|-
|知彼他三半{{按|GPT-3.5}}
|二〇二二年十一月
|初版,本於三點五之術。
|廢
|-
|知彼他三半特補{{按|GPT-3.5 Turbo}}
|[[二〇二三年]]
|較前版稍精,然猶出同源。
|廢
|-
|知彼他四{{按|GPT-4}}
|二〇二三年三月
|「加益」版{{按|ChatGPT Plus}}行世,技藝大進,改以四版為本。
|行
|-
|知彼他四奧{{按|GPT-4o}}
|[[二〇二四年]]五月
|其名「o」者,取西文「Omni」,意指萬象。文、圖、聲、影,無不納之,且善記人事,應對愈敏。常者用之有度,加益者則暢用無礙。
|行
|-
|知彼他四奧渺厘{{按|GPT-4o mini}}
|二〇二四年七月
|纖巧於四奧,價廉而捷,多以代三半。
|行
|-
|奧一預視{{按|o1-preview}}
|二〇二四年九月
|奧一之先覽版。
|行
|-
|奧一渺厘{{按|o1-mini}}
|二〇二四年九月
|以輕捷見長。
|行
|}
==據==
{{Reflist}}
[[分類:人工智能]]
6vonj8m5j5qnt2cd786t6psmeeg6yr3
大語言模型
0
124594
444241
420786
2026-08-06T19:14:34Z
Oct431925
120775
444241
wikitext
text/x-wiki
'''大語言模型''',語言模型之長也,基於[[深度學習]]之術。集海量文辭,納古今中外之言,融彙百家,煉成一身。可作文賦詩,解疑答惑,譯諸國之言<ref name=":1">{{Cite web |last=Ouyang |first=Long |date=2022-03-02 |title=Training language models to follow instructions with human feedback |url=https://arxiv.org/abs/2203.02155 |access-date= 2024-10-21 |website=Arxiv |language=en-US |url-status=live}}</ref>。
蓋模型之所以大,因其參數衆多,動輒數十億乃至千億,內存浩瀚如海,包羅萬象。其訓練源材,涵蓋[[經]][[史]][[子]][[集]]、[[詩]][[詩餘|詞]]歌賦、[[小説]][[戲曲]]、[[論文]]報告、網絡文摘,乃至居處之對話,無所不有。經年纍月,吸納衆長,漸成一家之言<ref name=":2">{{Cite web |last=Team |first=GLM |date=2024-06-18 |title=ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools |url=https://arxiv.org/abs/2406.12793 |access-date= 2024-10-21 |website=Arxiv |language=en-US |url-status=live}}</ref>。
然模型亦有不足之處,其所習皆爲舊聞,難以時新,故於時事變遷或有未逮。且模型之言,蓋爲模式匹配,淺不足與測深。
於大語言模型所施之咒,謂之[[提示詞]]。
==據==
{{Reflist}}
[[分類:人工智能]]
6mi8li36oldmv839fsvlrykyvmg70q0
用戶討論:Renamed user 15b4028f8b5ebfe957c699a5102b52b3
3
129245
444246
440629
2026-08-07T10:55:20Z
MdsShakil
88892
MdsShakil已移動頁面[[用戶討論:Cachydesu]]至[[用戶討論:Renamed user 15b4028f8b5ebfe957c699a5102b52b3]],不留重新導向:當重新命名使用者「[[Special:CentralAuth/Cachydesu|Cachydesu]]」至「[[Special:CentralAuth/Renamed user 15b4028f8b5ebfe957c699a5102b52b3|Renamed user 15b4028f8b5ebfe957c699a5102b52b3]]」時自動移動頁面
420129
wikitext
text/x-wiki
{{Template:Welcome|realName=|name=Cakyyy}}
-- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二五年七月三一日 (四) 〇八時四五分 (UTC)
7dlxoqvazt3gavtrawjykzmcq9js7dj
用戶討論:Renamed user 8c85e8421c2c47b8c3c94754483fb41a
3
129933
444247
422456
2026-08-07T10:55:33Z
Superpes15
85491
Superpes15已移動頁面[[用戶討論:Hoaivu2005]]至[[用戶討論:Renamed user 8c85e8421c2c47b8c3c94754483fb41a]],不留重新導向:當重新命名使用者「[[Special:CentralAuth/Hoaivu2005|Hoaivu2005]]」至「[[Special:CentralAuth/Renamed user 8c85e8421c2c47b8c3c94754483fb41a|Renamed user 8c85e8421c2c47b8c3c94754483fb41a]]」時自動移動頁面
422456
wikitext
text/x-wiki
{{Template:Welcome|realName=|name=Hoaivu2005}}
-- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二五年九月三日 (三) 一三時三四分 (UTC)
4bho3aqt09f010jdouufo1g00jimq40
信陽饑饉
0
132375
444245
427863
2026-08-07T10:39:01Z
一室幽蘭
105415
粗體
444245
wikitext
text/x-wiki
西元[[一九五九年]]十月至明年四月,{{Pn|[[河南省]]|'''[[信陽專區]]}}大饑''',人相食,死者十一二。
== 歷 ==
西元[[一九五七年]],{{Pn|[[毛澤東]]}}籲[[大躍進]],詐欺之風遂盛,謂畝產萬斤稻者有之。外官詐奏穀數,或倍於實情。五九年,徵糧,循去年之額,計一千三百五十億斤。七月,{{Pn|毛澤東}}斥{{Pn|[[彭德懷]]}}於{{Pn|廬山}},上下皆畏,層層相逼。雖歉收,強徵如故,不惜酷刑。
八月,{{Pn|河南省}}黨委書記{{Pn|[[吳芝圃]]}}還自{{Pn|廬山}},下傳東風。故吏不徵者治,民不捐者刑而毀其屋。是年饑饉,{{Pn|河南}}產糧二百一十億斤,芝圃估以四百五十億。
{{Pn|信陽專區}}實產二十億,諸縣衙咸詐告,彙得七十二億。區衙官{{Pn|張樹藩}}以爲三十億,見懲。卒區衙告行省以五十億,省令徵九億。威民以甲兵,竟徵十六億,至於種粒,又拘萬餘人。
秋,直徵糧於田壟。人皆謂豐年,萬戶無餘糧。嚴冬未屆,道有凍死骨。{{pn|[[光山縣|光山]]}}有醫,餓者求之,對曰食粥可愈,因是獲罪。故民諱言飢,浮腫者衆,飾以染疫,人死亦然。十月,公竈皆斷炊,餓殍暴於野。或棄嬰,拘父母。或私爨,破其釜。或殺牛,拘食牛者。人相食,拘食人者。人亡,設卒守道隘,截而拘亡者。或傳信,截信而拘書者。
時,{{Pn|信陽}}倉廩豐實,存糧十一億斤,皆懼,莫敢賑也。惟初九月{{Pn|樹藩}}賑於{{Pn|[[遂平]]}},旋見幽。民莫劫倉,惟數人踞門外,時時呼曰:「{{Pn|共產黨}}乎!{{Pn|毛主席}}乎!救我矣!」或忽斃焉。
明年二月,事發。朝使使視之,問{{Pn|樹藩}}曰:「餓斃者有諸?」對曰:「多之。」又問:「幾何?」對曰:「不知也,或二十餘萬。」驚而回稟。朝查之,謂斃者百有五萬人。{{Pn|信陽}}本八百有八萬人,死者十一二。
[[分類:中華人民共和國紀事]]
82njvy3rkeg2u0qpu7iisy05l5x1ego
用戶:Oct431925/深度求索
2
138660
444221
2026-08-06T17:30:28Z
Oct431925
120775
新文「1」
444221
wikitext
text/x-wiki
1
68m9lfln2dgvzieyrm8vqqf8ha8550r
444223
444221
2026-08-06T17:44:50Z
Oct431925
120775
444223
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化创首梁文锋等肇建于癸卯年。专研通仝之基大语言模型,并开放其权,享誉于世。
== 历史 ==
=== 深度求索-V3 ===
深度求索-V3,西历二零二四年十二月面世,并开源之巨擘语言模型。总参六千七百一十亿,每用则活三百七十亿。预训于十四万八千亿词元,尤擅算学、汉文,力敌GPT-4o、Claude-3.5-Sonnet之流。费二千余H800图形卡,历五十六日,糜金五百五十七万美金。吐属之速,每秒六十词元,初容十二万八千词元,后拓至百万。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西历二零二五年元月面世。专以强化学励,于算学、编码、推演诸端,可抗OpenAI o1。同月廿七日,登苹果中美商肆榜首,美区下载冠绝ChatGPT。竞技场得一千三百五十七分,微胜o1。训费仅二十九万四千美金。模型及权柄悉依MIT协约公开,复蒸馏六小模以惠众。其论文尝登《自然》封面,为大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西历二零二六年四月发布,分Pro、Flash二品。
Pro品:总参一万六千亿,活者四百九十亿,为至强之选。于智能体、博物、推演诸能,皆冠开源,用感胜Claude Sonnet 4.5,近Opus 4.6。
Flash品:总参二千八百四十亿,活者一百三十亿,务求廉速。推演之能近Pro,而用度约当其三分一。每百万词元入者费零一四美分,出者零二八美分,行费约当GPT-5.6 Sol六十之一。
二品皆本容百万词元,创“词元缩注心”之法,算力显存大省。西历二零二六年七月,复推“推测解词”之术,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
mxsljmmbwa8zg2zp76mqq9ygiwql74q
444224
444223
2026-08-06T17:46:17Z
Oct431925
120775
444224
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文檔
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
0fko1lwpo8r8mkb7mfcql3zn7u9o75w
444226
444224
2026-08-06T17:47:53Z
Oct431925
120775
已完成
444226
wikitext
text/x-wiki
#redirect [[深度求索]]
awur6w2ydfx424huanhhs3eharhfu3s
用戶討論:Oct431925
3
138661
444222
2026-08-06T17:30:29Z
New user message
64015
在新使用者的討論頁上添加[[Template:Welcome|歡迎資訊]]
444222
wikitext
text/x-wiki
{{Template:Welcome|realName=|name=Oct431925}}
-- [[用戶:丁子君|丁子君]] ([[用戶討論:丁子君|對話]]) 二〇二六年八月六日 (四) 一七時三〇分 (UTC)
7n30ho67b3r7gowvuw7k3o3zuunczxb
深度求索
0
138662
444225
2026-08-06T17:47:24Z
Oct431925
120775
新文「深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。 == 史 == === 深度求索-V3 === 深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十……」
444225
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文檔
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
<references/>
c8y97s9lwbvl6zbi9r3bxyqzy2wtvfw
444227
444225
2026-08-06T17:49:31Z
Oct431925
120775
444227
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 預覽版:邁入百萬上下文普惠時代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文檔
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
6i1ewqbmjnutp978ue50wl420wvwkzi
444228
444227
2026-08-06T17:50:29Z
Oct431925
120775
444228
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
6tefmgq39vu3zn18jij8sev2n78hzyv
444229
444228
2026-08-06T17:50:46Z
Oct431925
120775
444229
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二零二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二零二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二零二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二零二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
jkkbtgm67nufzieh2u1aunxcryrihz2
444230
444229
2026-08-06T17:55:02Z
Oct431925
120775
444230
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮注心」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
k9y5dtbplsuesbcjao7xd3h20o58el9
444231
444230
2026-08-06T18:32:52Z
Oct431925
120775
444231
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮維注心」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
p62lnn8cy7tu0p0wrpj3r8icjmme9te
444232
444231
2026-08-06T18:37:30Z
Oct431925
120775
444232
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->大語言模型,並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
81qnszmbgbemdmafh8x56knyo7kil6b
444233
444232
2026-08-06T18:46:37Z
Oct431925
120775
444233
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕ChatGPT。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
6lltu50eh4wmlgykzxvelojkbm0yopn
444234
444233
2026-08-06T18:47:34Z
Oct431925
120775
/* 深度求索-R1 */
444234
wikitext
text/x-wiki
深度求索,杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕[[ChatGPT]]。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
5k6csutby8ttpunst8n06ns58avrwgu
444244
444234
2026-08-07T10:27:04Z
一室幽蘭
105415
粗體
444244
wikitext
text/x-wiki
'''深度求索''',杭州科企也,幻方量化創首梁文鋒等肇建於癸卯年(二〇二三年)。專研通仝之基<!-- 通用人工智能底層 -->[[大語言模型]],並開放其權,享譽於世。
== 史 ==
=== 深度求索-V3 ===
深度求索-V3,西曆二〇二四年十二月面世,並開源之巨擘語言模型。總參六千七百一十億,每用則活三百七十億。預訓於十四萬八千億詞元,尤擅算學、漢文,力敵GPT-4o、Claude-3.5-Sonnet之流。費二千餘H800圖形卡,歷五十六日,糜金五百五十七萬美金。吐屬之速,每秒六十詞元,初容十二萬八千詞元,後拓至百萬。<ref name="v3-tech-report">{{cite web
| title = DeepSeek-V3 Technical Report
| url = https://arxiv.org/abs/2412.19437
| website = arXiv
| date = 2024-12-25
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-R1 ===
深度求索-R1,西曆二〇二五年元月面世。專以強學勵,於算學、編碼、推演諸端,可抗OpenAI o1。同月廿七日,登蘋果中美商肆榜首,美區下載冠絕[[ChatGPT]]。競技場得一千三百五十七分,微勝o1。訓費僅二十九萬四千美金。模型及權柄悉依MIT協約公開,復蒸餾六小模以惠眾。其論文嘗登《自然》封面,為大模型之首例。<ref name="r1-tech-report">{{cite web
| title = DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
| url = https://arxiv.org/abs/2501.12948
| website = arXiv
| date = 2025-01-22
| accessdate = 2026-08-07
}}</ref>
=== 深度求索-V4 ===
深度求索-V4,西曆二〇二六年四月發佈,分Pro、Flash二品。
Pro品:總參一萬六千億,活者四百九十億,為至強之選。於智能體、博物、推演諸能,皆冠開源,用感勝Claude Sonnet 4.5,近Opus 4.6。
Flash品:總參二千八百四十億,活者一百三十億,務求廉速。推演之能近Pro,而用度約當其三分一。每百萬詞元入者費零一四美分,出者零二八美分,行費約當GPT-5.6 Sol六十之一。
二品皆本容百萬詞元,創「詞元縮維注心<!-- Token-Dimensional Compression Attention Mechanism -->」之法,算力顯存大省。西曆二〇二六年七月,復推「推測解詞<!-- speculative decoding -->」之術,推速最高增八成五。<ref name="v4-release">{{cite web
| title = DeepSeek-V4 预览版:迈入百万上下文普惠时代
| url = https://api-docs.deepseek.com/zh-cn/news/news260424/
| website = DeepSeek API 文档
| date = 2026-04-24
| accessdate = 2026-08-07
}}</ref>
== 考據 ==
{{Reflist}}
[[分類:人工智能]]
ti7sv256tfezren5h6h4uhguip09pxp
DeepSeek
0
138663
444238
2026-08-06T18:55:26Z
Oct431925
120775
渡至[[深度求索]]
444238
wikitext
text/x-wiki
#redirect [[深度求索]]
awur6w2ydfx424huanhhs3eharhfu3s
提示詞
0
138664
444239
2026-08-06T19:12:26Z
Oct431925
120775
新文「夫'''提示詞'''者,人之於大語言模型所施之咒也。善為者,可發號精準,令仝協理萬務。 模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。 斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。 [[分類:人工智能]]」
444239
wikitext
text/x-wiki
夫'''提示詞'''者,人之於大語言模型所施之咒也。善為者,可發號精準,令仝協理萬務。
模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。
斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。
[[分類:人工智能]]
kgqxu8j9c7ly4iaxwjnt9rgx85xp2im
444240
444239
2026-08-06T19:13:25Z
Oct431925
120775
444240
wikitext
text/x-wiki
夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。
模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。
斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。
[[分類:人工智能]]
qnf2gbu8bpahukvhl7us2rxi4smjrlx
444242
444240
2026-08-06T19:15:05Z
Oct431925
120775
444242
wikitext
text/x-wiki
夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。
模型內蘊之定式,謂之系統提示詞{{按|system prompt}}。今世智者,已窺數法,能誘其自吐腹中所藏。
斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。
[[分類:人工智能]]
qrmumhkqiug3oz5dkzuzlv4ct8092ga
444243
444242
2026-08-06T19:15:19Z
Oct431925
120775
444243
wikitext
text/x-wiki
夫'''提示詞'''者,人之於[[大語言模型]]所施之咒也。善為者,可發號精準,令[[人工智能|仝]]協理萬務。
模型內蘊之定式,謂之系統提示詞。今世智者,已窺數法,能誘其自吐腹中所藏。
斯詞又能指麾智能體,使畢其役於無人,且可綴合成智能體之技{{按|agent skill}}。
[[分類:人工智能]]
qnf2gbu8bpahukvhl7us2rxi4smjrlx