【大紀元2026年08月22日訊】(大紀元記者李淨綜合報導)正值中國人工智能新創公司「深度求索」(DeepSeek)展開第二輪融資之際,一段有關DeepSeek論文造假的視頻引發網絡關注。一名養生科普內容創作者在使用DeepSeek撰寫健康科普文案時發現,AI生成的論文標題、數據乃至DOI編號看似完整詳實,但經逐一核實後均無法對應真實文獻,暴露出AI在專業內容生成中可能存在編造信息的風險。
撰寫科普文案 DeepSeek給出的論文竟是自編的
近日,一段有關DeepSeek的視頻在社交平台X上引發熱議。視頻中,一名長期從事健康科普內容創作的博主在使用DeepSeek撰寫咀嚼與老年認知相關文案時,意外發現AI提供的科研依據存在嚴重問題。
她輸入的要求是:「請幫我寫一篇咀嚼能夠幫助老年人改善大腦認知、延緩大腦衰老的抖音文案,並且強調要以科研數據為根據。」
DeepSeek隨後生成了一份帶有科研依據的文案。其中一項數據尤其引起她的注意,即「每天咀嚼30次以上的老人認知衰退風險降低42%」,並附上了所謂的文獻來源。
「我當時看到這個科研證據的時候,我讀了這麼多文獻,好像沒有印象看到過這樣的數據。」
當時她並沒有立即懷疑AI,而是認為自己可能遺漏了相關研究,因此開始在多個文獻數據庫中按照關鍵詞、期刊名稱等信息進行檢索。
結果卻沒有找到對應的研究。
隨後,她再次詢問DeepSeek「咀嚼改善認知的科學證據」。DeepSeek又生成了一份更長的資料,並列出了多項所謂科研依據,其中還總結稱,咀嚼相較於每週進行兩次有氧運動,對預防痴呆的效果更好。
「這個科研證據我也沒有看到。」她說。
追問英文原文後 DeepSeek承認此前說法存在問題
為了進一步確認資料來源,這名播主將DeepSeek此前給出的相關內容複製下來,要求其提供英文原始論文名稱。
這一次,DeepSeek先承認此前的說法存在問題,並表示沒有找到此前提到的相關論文,隨後又給出了三篇所謂「更權威」的研究,並同時提供論文標題和DOI。
DOI是由國際標準化組織(ISO)制定的學術論文、研究數據等數字資源的全球唯一且永久有效的代碼,如同網絡文獻的「身分證」。
她隨後按標題與DOI逐一檢索,結果均未能對應。第一篇論文按照標題搜索後完全不存在。隨後,她按照DeepSeek提供的DOI進行搜索,雖然出現了一篇論文,但論文標題與DeepSeek給出的完全不同。
第二篇論文同樣無法通過標題找到,而其提供的DOI甚至不存在。第三篇論文也出現類似情況:論文標題無法檢索,而DOI對應的卻是另外一篇完全不同的文章。
這一系列核查讓她確認,DeepSeek此前提供的相關文獻證據基本屬於編造。
DeepSeek造假包裝完美 博主提醒勿輕信
在確認DeepSeek編造文獻的問題後,這名博主進一步反思了AI生成內容可能帶來的深層風險。
這名博主表示,DeepSeek生成內容的問題並不僅限於是否存在編造的論文,還可能表現為對研究結論的誇大或曲解。
在她看來,DeepSeek最容易造成的問題,恰恰是它能夠把一個並不可靠的結論包裝得非常完整:有數據、有論文名稱、有期刊、有DOI,還有一套看起來邏輯嚴密的解釋。
「DeepSeek居然編造了一個非常完美的科研數據,而且這個數據對我來講,它可能恰恰是我喜歡的、我所需要的。」
她坦言,如果不是自己長期從事文獻核查工作,很可能也會被這類「完美」的假數據說服。
健康科普使用AI批量生產 虛假信息風險更值得警惕
這名播主特別擔憂的是,當前「大健康」內容受到關注,不少博主正在利用AI快速生產文字、短視頻和科普內容。在流量競爭下,如果創作者直接把AI生成的內容當成經過驗證的科學資料,錯誤信息可能進一步傳播。
她認為,AI可以作為檢索、整理和寫作輔助工具,但不能替代原始文獻的人工核查。
這名播主還提醒,科學傳播應避免「單篇論文決定結論」的誤區。她說,「我每次在講一個話題的時候,我不是只看一篇文獻,而是要將這一個領域基本上的所有文獻都要把它去過一遍。」
對於上述播主的評論,有網友說:「這不是刻意造假,是中國早期AI軟體的生成結果,是根據『過去大量資料』整合出來的,並不會針對某篇文獻進行剖析。西方AI這幾年逐漸可以生成準確的文獻資料。」
還有網友表示:「現在越來越多的人一看到事情,就馬上直接問AI是不是真的,越來越多人在討論問題時,居然是把AI給的結論當成是真理、是論據,來佐證自己的觀點。以後再遇到這樣的無腦人或有腦不用的人,我就直接甩這個視頻給他,讓他看看AI是怎樣絲滑造假騙人的,省得浪費時間了。」
值得注意的是,據《紐約郵報》8月19日報導,一份題為「生成式AI帶來的學習懲罰:來自中國中等教育的證據」的研究報告顯示,中國學生普遍用人工智能AI輔助學習。而使用AI的學生,其作業成績雖顯著提升,但在考試中的表現卻明顯退步。
研究指出,受訪學生中約80%表示使用了中國本土人工智能模型,包括深度求索(DeepSeek)、豆包(Doubao)等,其餘20%作為對照組。
DeepSeek中止融資 創辦人洩漏國產芯片真實算力
除了上述爆出的DeepSeek涉嫌編造科研文獻之外,近期圍繞DeepSeek還出現多項與公司運營和技術能力相關的消息,同樣引發外界關注。
據彭博社7月25日引述知情人士報導,DeepSeek第二輪融資突然被叫停,導火索是其創辦人梁文鋒此前一段講話流出。其在講話中「洩露」了中國AI的真實水平,以及通過非法途徑獲得美國AI芯片和技術的內幕,證實了美國方面一直以來的指控,或讓該公司同時面臨中美兩國監管機構的特別關注。
根據網絡流傳的梁文鋒講話錄音顯示,他在投資人交流會上罕見坦承,相較美國同行,中國AI公司僅能訓練「小十倍」的模型。
他說,DeepSeek目前僅擁有約兩萬張相當於英偉達(NVIDIA)H系列的等效算力芯片,且大部分是近一兩個月才到貨。
他直言,以現有算力規模,公司根本無法訓練出與美國同行相當的頂尖大模型,即便把首輪融資募得的500億元人民幣全數投入也「訓不起」。
他說:「在現在最大的模型上,我們其實是訓練不起的。我們哪怕把500億(第一輪融資的全部資金)全部花掉,其實也訓不起。哪怕能(把模型)堆起來也用不起。」
他還透露,美國業界最大模型的參數啟動規模(Active Parameter Size/激活參數量)約達800億級,而中國目前最大模型僅在數十億級,兩者相差一個數量級。
在AI大模型技術中,「參數啟動規模」指的是模型在處理每一次輸入或生成每一個字(Token)時,真正參與運算的參數總量。
他進一步說:「對我們來講,我們可以買一些不合規(受美國出口管制)的卡。所以我們買華為950的目的,還是希望幫華為把這個生態做好。一萬六千個華為950卡,只相當於四千個(英偉達)B系列卡。所以說這不是一個很大的量,意義不是很大。」
DeepSeek於今年6月完成首輪外部股權融資,公司估值超過4,000億元人民幣。
據報導,此輪融資採用特殊架構,機構投資方不享有投票權,且股權設有五年鎖定期。
不過,中共國家集成電路產業投資基金(俗稱「大基金」)的10億元投資較為特殊,資金直接注入DeepSeek主體,同時保留投票權,也不受五年鎖定期約束。大基金是中共政府在半導體行業的產業投資基金。
責任編輯:孫芸#


















留言