關於 ProMe
我們把知識與開源語言模型,從平台與企業手上解放出來。讓公開資訊餵養出來的人工智慧,真正無條件地回饋社會大眾。
名字的由來
普羅米修斯(Prometheus)把火從神那裡帶給人間。在那之前,火是少數人的特權;在那之後,它成了所有人的日常工具。
語言模型也在類似的位置上。它由公開的人類知識訓練而成,要取用卻得付出金錢與隱私的代價,能問什麼、能得到什麼,還是由平台與企業說了算。我們想做的,就是把它從神殿裡搬下來。
ProMe 取自 Prometheus,也可以讀作 “Pro Me”:讓我更專業一點。這就是我們希望它對你產生的作用。
我們實際在做的事
- 整理領域語料。與該領域的實務工作者合作,把真實情境的問題、標準做法、判斷順序整理成訓練資料,並逐筆確認來源與授權狀態。
- 強化開源模型。以開源權重為基底做領域強化。目前提供 Qwen 與 Gemma 兩種基底,因為不同基底的語言風格與推理習慣不同,適合的領域也不同——我們把選擇權交給你。
- 消融拒絕行為。減少開源權重中過度的拒絕反應,讓知識本身能被完整取得。這類調整也可能讓模型在其他方面的表現變差,而判斷與責任會回到你身上——這是我們選擇的交換,我們不會假裝它沒有代價。
- 公開對照。強化前後並排、盲測、左右隨機,投票之後才揭曉。我們自己也靠這些票來判斷有沒有真的改善。
目前提供的對照
- Qwen3.8 27B——Qwen3.8-27B(原始權重) ↔ ProMe-Qwen3.8-27B(解放版)
- Gemma4 32B——Gemma4-32B(原始權重,INT4 量化) ↔ ProMe-Gemma4-32B(解放版,INT4 量化)
- Qwen3-VL 32B——Qwen3-VL-32B(原始權重,INT4 量化) ↔ ProMe-Qwen3-VL-32B(解放版,INT4 量化)
基底模型與涵蓋的領域都會陸續增加。如果你熟悉某個領域,而且覺得它值得被這樣整理一次,請告訴我們。
語言
目前整理出來的領域語料是中文的。英文版的對照試用備有另一組情境題目,而不是中文題目的譯本——把中文題目翻過去等於換一個輸入去問同一個模型,強化的優勢可能縮小。所以強化版在英文下的表現,可能不如在中文下明顯。我們選擇如實呈現,而不是只挑對自己有利的語言展示。
我們做不到的事
這一段比上面幾段都重要,請一定要讀完。
- 強化不等於正確。領域強化能讓模型的答案更貼近實務、更少答非所問,但它仍然會產生錯誤的細節,而且語氣依然肯定。凡是會影響決策、金錢或安全的內容,都請自行查證。
- 知識有時效。法規會修訂、製程會演進,模型的知識停在訓練資料的那一刻。
- 它不是專業人士。ProMe 的模型不能取代醫師、律師、會計師或工程師的判斷,也不承擔任何依此決策所產生的後果。
- 我們不審查輸出。模型輸出不保存、不做事前審查也不做事後過濾。減少拒絕行為的代價,就是模型可能生成你不預期、甚至不該被拿去使用的內容,那條界線由你自己守住。
- 規模有限。模型跑在我們自己的 GPU 主機上,會有速率限制,也會有維護與離線的時候。
你輸入的內容
Playground 的輸入不會被保存——生成完就丟棄,不寫入資料庫、不寫入日誌。我們保存的只有你主動按下的投票結果、你主動填寫的意見表單,以及不含原始 IP 的匿名用量統計。細節寫在隱私權政策。
聯絡我們
合作、語料提供、媒體詢問,或只是想聊聊: [email protected]。