Basalt Labs 涉 AI 模型詐騙:HLE 評分灌水,釋出與服務模型皆非所稱
r/LocalLLaMA 揭露 Basalt Labs 的潛在詐騙行為,指出其模型來源,提供使用者警示。
Basalt Labs 近期在 AI 業界引發爭議,被社群指控實施「世代級愚蠢詐騙」。主要爭議點在於該公司對其 AI 模型效能的極度誇大以及其模型來源的混淆。Basalt Labs 聲稱其模型在 HLE(人類水準評估)工具輔助下達到驚人的 99.44% 分數,此一數字引發廣泛質疑。 • 該公司在 Hugging Face 上釋出的 Monolith-1.0 模型,實際上是基於開源的 Qwen2.5-7B-Instruct 進行微調。 • 更甚者,他們官方網站提供的聊天演示服務,使用的卻是另一款公開模型 DeepSeek。
評論指出,這種做法顯示 Basalt Labs 試圖透過虛假宣傳誤導大眾及潛在投資者,嚴重損害了 AI 領域的信任度。此事件凸顯了 AI 社群對模型透明度和公正評估的日益重視,呼籲業界應摒棄欺騙行為。
來源:r/LocalLLaMA
閱讀原文 ↗另見:r/LocalLLaMA