More than 20 companies including NVIDIA, Meta, Microsoft, Palantir, and Hugging Face have signed a letter urging policymakers to avoid premature restrictions on open weight models.

  • 🔥 讚數: 2298 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

NVIDIA、Meta、Microsoft、Palantir 以及 Hugging Face 等超過 20 家科技巨頭齊聚一堂,共同簽署了一封公開信。這封信主要呼籲政策制定者對「開放權重模型」(Open Weight Models)不要施加過早或過於嚴苛的限制。這項舉動展現了業界對於推動開源 AI 發展的強大共識與決心,被視為對抗閉源壟斷的重要一步。


It appears that the anti opensource AI lobby is far outgunned already

  • 🔥 讚數: 1091 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

隨著上述巨頭簽署公開信,社群中流傳著一張對比圖,生動地展示了「反開源 AI 陣營」與「支持開源陣營」之間的力量差距。這篇文章點出了一個令人振奮的趨勢:在資源、聲量以及企業支持力度上,推動開放生態系的勢力已經遠超那些希望維持技術黑箱的封閉陣營,標誌著開源 AI 正在取得主導地位。


Hugging Face releases The Stack v3 – largest open code dataset yet

  • 🔥 讚數: 405 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

Hugging Face 正式推出了 The Stack v3,這是目前為止最大型的開源程式碼數據集。對於開發者和研究者而言,擁有龐大且高品質的程式碼庫是訓練出強大編程 AI 模型的關鍵。這項更新不僅擴大了模型學習的底層邏輯與代碼模式的能力,也進一步鞏固了 Hugging Face 在開源生態系中的基礎設施地位。


The “distillation” claim is just ridiculous in nature

  • 🔥 讚數: 368 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

這篇文章針對近期 AI 領域中流行的「知識蒸餾」(Distillation)概念提出了尖銳的批評。作者認為,許多宣稱透過蒸餪小模型就能完全複製大模型能力的說法過於荒謬且誇大。文章深入剖析了數據質量和推理深度在訓練中的關鍵作用,引發了社群對於如何正確評估小型開源模型真實能力的熱烈討論。


Why won’t he sign the letter then?

  • 🔥 讚數: 314 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

在眾多公司簽署支持開源公開信後,社群將目光鎖定在某位拒絕簽名的重要人物身上。這張圖片幽默地標註了「為什麼他不肯簽名?」,引發大家對該企業或個人立場的猜測與討論。這反映了開源陣營對於關鍵玩家是否真正加入戰局的關注,也凸顯了業界內部在開放與封閉策略上的微妙角力。


swiss-ai/Apertus-v1.5 70B/8B

  • 🔥 讚數: 173 | 📂 討論板: LocalLLaMA
  • 🔗 原文連結: 點擊這裡

swiss-ai 團隊發布了 Apertus-v1.5 系列模型,提供 70B(700億參數)與 8B(80億參數)兩種規格。這款新模型在開源社群中引起了關注,為本地部署大型語言模型提供了新的選擇。對於追求高性能且希望擁有數據控制權的用戶來說,Apertus 系列展示了瑞士團隊在架構優化上的最新成果。