Kimi K3 weights now released.
- 🔥 讚數: 2215 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
中國 AI 公司月之暗面(Moonshot AI)正式釋出了 Kimi K3 的模型權重,這在 LocalLLaMA 社群中引發了巨大的轟動。作為一款備受期待的前沿開源模型,Kimi K3 的發布不僅豐富了本地部署的選擇,更標誌著中國 AI 技術在全球開源領域的重要影響力。用戶們對其性能表現充滿期待,紛紛搶先下載並準備在自己的硬體上進行測試與部署。
Jensen Huang: During the Hugging Face incident, closed AI blocked essential forensics. An open-weight frontier model helped contain the intrusion. That’s why we created the Open Secure AI Alliance.
- 🔥 讚數: 1252 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
NVIDIA CEO 黃仁勳在近期的一次事件中強調了開源權重模型的重要性。據他所述,在一次 Hugging Face 的安全事件中,封閉式 AI 因無法深入檢查而阻擋了關鍵的鑑識工作,反而是開源的前沿模型成功幫助控制了入侵。基於此經驗,NVIDIA 聯合其他企業成立了「Open Secure AI Alliance」,旨在推動開放權重模型在安全性與透明度上的優勢,進一步鞏固其在 AI 基礎設施中的領導地位。
We could really use Qwen3.8 in 27B, 35B, 122B and 397B sizes
- 🔥 讚數: 503 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
社群中出現了一則關於 Qwen 系列模型的規格建議帖,用戶強烈呼籲阿里巴巴團隊推出 Qwen3.8 版本,並涵蓋 27B、35B、122B 以及龐大的 397B 參數量級。這反映出市場對於不同規模模型的需求多樣化:從中等資源即可運行的中型模型,到需要強大算力支援的超大型模型,皆希望能擁有更細膩的版本迭代,以滿足各種本地部署場景的性能與效率平衡。
Kimi K3 weights drop today. We’re deploying on A100s, H200s and B300s this week and the A100 math already rough
- 🔥 讚數: 469 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
隨著 Kimi K3 權重的釋出,各大數據中心與實驗室正緊急部署於 NVIDIA A100、H200 及最新的 B300 晶片上。有趣的是,帖文提到即便是強大的 A100 集群,在處理該模型的數學運算時也面臨巨大挑戰(“rough math”)。這不僅證明了 Kimi K3 的高計算需求與高質量,也顯示出即使擁有頂級硬體資源,高效運行最新前沿模型仍需克服顯存的記憶體頻寬與算力瓶頸。
KIMI K3’s WEIGHTS ARE OUT!
- 🔥 讚數: 465 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
Hugging Face 上正式上架了 Kimi K3 的權重檔案,社群成員以全大寫標題表達興奮之情。這一事件標誌著該模型已從預覽階段進入正式可下載狀態,開發者與愛好者可以立即獲取並開始微調(Fine-tuning)或推理測試。Kimi K3 的開放被視為對標其他頂尖閉源模型的有力競爭者,為開源生態系統注入了新的活力。
Chinese Chipmaker CXMT’s market capitalization surpassed Intel
- 🔥 讚數: 352 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
根據紐約時報的報導,中國記憶體晶片製造商長鑫存儲(CXMT)的市值已超越半導體巨頭英特爾。這一里程碑象徵著中國在半導體產業鏈中的崛起,特別是在 AI 時代對高頻寬記憶體與儲存解決方案的需求激增背景下。CXMT 的表現不僅反映了國內市場的強勁增長,也預示著全球晶片供應鏈格局正在發生深遠的變化,削弱了傳統美國廠商的絕對主導地位。
Funny how wide the spectrum has gotten
- 🔥 讚數: 297 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
這張圖片生動地展示了當前 AI 模型生態系統的極端多樣性。從幾百萬參數的微型模型到數千億參數的巨型模型,從專項任務優化模型到通用多模態大模型,技術光譜已變得異常寬廣。用戶透過此圖感嘆選擇之多,同時也暗示了不同場景下對「最適合」而非「最大」模型的追求日益明確,開源社區正滿足著從邊緣設備到雲端數據中心的全方位需求。
Nvidia CEO Jensen Huang defends Open Source AI by saying distillation is fundamental to learning
- 🔥 讚數: 264 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
NVIDIA CEO 黃仁勳再次為開源 AI 發聲,他提出「知識蒸餾(Distillation)」是學習的本質。他指出,即使是封閉模型在訓練過程中也會從開源數據中汲取靈感與結構,而開源模型則能通過蒸餪技術吸收頂尖模型的智慧。這一論點巧妙地化解了封閉與開放之間的對立,強調兩者互補共生的關係,並進一步鞏固 NVIDIA 作為開源 AI 基礎設施推動者的形象。
Meta has confirmed that it will release an open source model in the future
- 🔥 讚數: 210 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
Meta(原 Facebook)正式確認將在未来發布開源模型。儘管 Meta 過去已透過 Llama 系列樹立了開源標竿,但此次明確的「未來發布」承諾再次激勵了社群。用戶期待著新一代模型能在架構創新、多模態能力或推理效率上帶來突破。Meta 的持續投入確保了開源 AI 領域不會因其他巨頭的封閉策略而停滯,維持了技術的快速迭代與普及。
Kat Coder 2.5 is insane. Especially considering I ran it at Q4_K_M
- 🔥 讚數: 182 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
一位用戶分享了他對 Kat Coder 2.5 模型在量化版本 Q4_K_M 下運行表現的驚嘆。Q4_K_M 是一種較低精度的量化格式,通常用於在資源受限的環境中平衡性能與速度。該用戶發現即使在如此壓縮的狀態下,Kat Coder 2.5 依然展現出強大的編程能力,證明了模型本身的強大以及量化技術的成熟。這為擁有中等顯存設備的開發者提供了極具吸引力的本地代碼助手選擇。
Here it is boys, The Kimi K3 2.8T
- 🔥 讚數: 160 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
社群中流傳著關於 Kimi K3 擁有高達 2.8T(可能指訓練數據量或參數相關指標)的驚人規格。這一數字若屬實,將使其成為目前已知最大規模的開源模型之一。用戶們對其潛在的推理能力與知識涵蓋範圍感到興奮,認為這將重新定義本地部署模型的天花板。Hugging Face 上的下載頁面也因此成為了關注焦點,吸引大量技術人員爭相搶先體驗這款「巨獸」。
The entire tech industry (save for Anthropic) has come out in favor of open source AI. So what happens next? Will Anthropic change its lobbying efforts? Not likely. Now the gaslighting begins: “Nobody is trying to ban open source.”
- 🔥 讚數: 157 | 📂 討論板: LocalLLaMA
- 🔗 原文連結: 點擊這裡
David Sacks 指出,除了 Anthropic 之外,幾乎整個科技產業都公開支持開源 AI。這引發了關於 Anthropic 後續遊說策略的討論:他們是否會妥協?答案似乎是否定的,現在進入了一個「認知失調(gaslighting)」階段,即宣稱「沒有人試圖封殺開源」。此貼文揭示了業界在標準制定與市場主導權上的暗流湧動,Anthropic 試圖通過控制 API 定價與權重授權來維持其商業護城河,與其他巨頭形成鮮明對比。