tradingkey.logo
搜尋

湯森路透基於中國Qwen平臺構建了Claude的替代方案。

Cryptopolitan2026年8月25日 13:24
facebooktwitterlinkedin

湯森路透已開始將其部分法律人工智能任務從Anthropic公司的Claude系統轉移到Thomson-1系統。Thomson-1是湯森路透自主研發的人工智能模型,採用中國開源技術。此舉有望降低成本,但同時也引發了另一個問題:在當前充滿不確定性的行業環境下,使用中國人工智能解決方案的安全性如何?.

據《商業內幕》報道,Thomson-1 將接手 Claude 此前負責的文件審覈流程。使用 CoCounsel 及類似產品的法律專業人士、會計師和各類公司可能不會感受到任何顯著的操作變化。然而,最能說明問題的是,這家西方信息公司對這家經過內部重大調整的中國公司的能力表示信任。.

比克勞德便宜,這是有意爲之。

費用在此案中扮演了至關重要的角色。首席技術官喬爾·赫倫向《商業內幕》解釋說,Anthropic 和 OpenAI 等實驗室收取的高額費用促使湯森路透考慮開發自己的模型。通過開發自己的模型,該公司可以利用其知識產權,而無需向第三方支付服務分包費用。.

Hron解釋說,Thomson-1不會完全取代Anthropic。湯森路透在5月份加強了 合作 ,而CoCounsel目前主要使用Claude系統。該公司計劃循序漸進地推進,僅在能夠發揮自身專業優勢的情況下才會將任務交給Thomson-1處理。初期,計劃將Thomson-1的系統用於“大量結構化文檔的審閱”。

Qwen“重新調整”的真正含義

Thomson-1 是 基於 Snowdon 模型構建的,而 Snowdon 模型是通過“重新調整”阿里巴巴的開源 Qwen 模型創建的。與通過 Anthropic 平臺以封閉系統形式訪問的 Claude 模型不同,Qwen 的開放權重可以下載和修改。

湯森路透和倫敦帝國理工學院的一個團隊花費數月時間將Qwen移植到Snowdon平臺,Hron稱其“在倫理和政治上都已消除偏見,使用起來很安全”。Cryptopolitan Cryptopolitan 曾報道,西方公司越來越多地 採用外國的開放權重模型, 以更好地控制其人工智能堆棧。Hron還淡化了對阿里巴巴模型的依賴,稱“我們與Qwen之間並沒有什麼必然的聯繫”。

湯森路透表示,Thomson-1 在其更廣泛的評估套件中,性能與 Claude Opus 4.8 相當,並優於 GPT-5.5、Claude Sonnet 5 和 Gemini 3.1 Pro。目前,這些結果仍由公司發佈,dent 的學術基準測試仍在進行中。已公佈的分數顯示,其表現參差不齊,並非完全領先。.

對使用中國開源模型的擔憂

這些節省成本的同時也帶來了政治隱患。Anthropic公司指責中國實驗室非法“提煉”其模型輸出結果,並敦促華盛頓方面採取限制措施。參議員湯姆·科頓也對美國公司使用中國開源模型的安全問題表示擔憂。.

斯坦福大學的研究人員則看到了不同的問題。HAI公司的詹姆斯 ·蘭迪 認爲,可下載的模型權重並不能使系統完全可審計,因爲用戶仍然無法查看其訓練數據或瞭解其所有行爲。他稱之爲“開放分發”,而非開源。這使得客戶難以獨立dent。

基準湯姆遜-1-大號克勞德作品 4.8GPT-5.5克勞德·索內特 5Gemini 3.1 Pro
斯坦福法律法庭0.8230.8180.832未發佈0.843
PRBench 法律硬0.3520.3150.333未發佈0.293
哈維法律代理基準0.8570.8690.781未發佈0.555
遵循以下說明0.9140.8610.885未發佈0.848
推理0.6840.7370.589未發佈0.748
編碼0.3990.5980.414未發佈0.500
長篇背景0.7530.7410.703未發佈0.750
培訓中使用的湯森路透專有內容<10%不適用不適用不適用不適用
Claude Sonnet 5 被納入湯森路透的整體性能聲明中,但並未出現在該公司發佈的數值對比圖表中。指令跟蹤測試結合了 IFEval 和 FollowBench;推理測試結合了 GPQA Diamond、Humanity's Last Exam 和 MMLU-Pro;編碼測試結合了 SWE-Bench Pro 和 Terminal-Bench 2.1;長上下文測試結合了 Infinity Bench 和湯森路透內部基準測試。數據來源:湯森路透 2026 年 7 月 31 日發佈的早期基準測試版本.

以月爲單位的差距

由於中國模型發展迅速,企業願意權衡利弊。斯坦福大學2026年人工智能指數指出,中美人工智能性能差距已“基本消除”。截至2026年8月21日,在Arena的文本處理排行榜上,美國領先模型得分1508分,中國領先模型得分1489分,差距僅爲1.3%。阿里巴巴的Qwen3.8-Max得分爲1481分。當性能差距僅爲幾分,而成本卻相差懸殊時,文檔審閱自然成爲檢驗更經濟替代方案的理想場所。.

 

不要只是閱讀加密貨幣新聞,要理解它。訂閱我們的新聞簡報, 完全免費。

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。

推薦文章

tradingkey.logo
風險提示:我們的網站和行動應用程式僅提供關於某些投資產品的一般資訊。Finsights 不提供財務建議或對任何投資產品的推薦,且提供此類資訊不應被解釋為 Finsights 提供財務建議或推薦。
投資產品存在重大投資風險,包括可能損失投資的本金,且可能並不適合所有人。投資產品的過去表現並不代表其未來表現。
Finsights 可能允許第三方廣告商或關聯公司在我們的網站或行動應用程式的任何部分放置或投放廣告,並可能根據您與廣告的互動情況獲得報酬。
© 版權所有: FINSIGHTS MEDIA PTE. LTD. 版權所有