密涅瓦()是一個由義大利羅馬大學自然語言處理研究所(Sapienza NLP)所開發的大型語言模型,該團隊隸屬於羅馬薩皮恩扎大學,由羅伯托·納維利(Roberto Navigli)領導。此模型從零開始訓練,主要是義大利語。
這是一個用於自然語言處理任務的模型,能夠理解並生成類似人類的文本。該模型運用了深度學習技術,特別是Transformer架構,來處理和生成文本。它已在大量文本資料上進行訓練,並經過微調以執行各種語言任務,例如語言翻譯、文本摘要和問答。
模型
Minerva 7B
Minerva 7B 擁有 70 億個參數,並在一個包含約 2.5 兆個標記(token)的資料集上進行訓練,其中義大利語和英語文本各佔一半,另外還有 2,000 億個標記的程式碼。
Minerva 7B 的開發是在「未來人工智慧研究」(Future Artificial Intelligence Research, FAIR)計畫下進行,並與CINECA合作,由後者提供Leonardo超級電腦進行訓練。其他貢獻來自 Babelscape 和 CREATIVE PRIN 計畫。值得注意的是,Minerva 模型是真正開放的,其資料和模型均可供公眾存取。
ChatMinerva
2026 年,Minerva 大型語言模型的一個擴展版本被整合到一個多模態人工智慧助理 ChatMinerva 中,該版本能夠處理長文件和視覺輸入,並結合了網路搜尋、增強的安全性和光學字元辨識元件。
參考文獻
參見
- 羅馬第一大學
外部連結
*
- [https://chatminerva.org ChatMinerva]
评论 (0)