ChatVPet 專案
介紹
ChatVPet 是《虛擬桌寵模擬器》專屬的語言模型專案。在早期測試中,我們發現未經針對性訓練的通用 AI 往往表現不佳,存在反應遲鈍、言語邏輯混亂等問題。為了賦予桌寵真正的靈魂,我們啟動了 ChatVPet 專案,旨在透過收集真實的聊天資料,從零開始建立專屬的 AI 訓練庫。
本專案基於 ChatGLM-6B 架構,使用 LLaMA-Factory 框架進行深度微調,所有資料收集均已獲得使用者明確授權。ChatVPet 遵循 GPL3 開源協議,支援二次修改(需保持開源並署名)。目前由於樣本量限制,專案暫時僅支援簡體中文的提交與訓練,其他語言支援敬請期待。
「桌寵的生命只有兩分鐘,我要給她完整的一生。」
- 專案開源位址:GitHub - ChatVPet
如何參與訓練?
ChatVPet 訓練與審核指南
專案區塊簡介
專案分為提交訓練內容和桌寵小法庭兩個核心部分。
提交訓練內容
在此您可以發揮創意,為桌寵製作聊天內容,並根據桌寵設定狀態。
- 靈感輔助:可使用簡易 AI 產生回覆(扣除 25 折 Token 點數),但嚴禁直接提交 AI 產生內容。
- 獎懲機制:
- 審核通過(贊成 > 60%):內容進入訓練庫,根據投票數和內容量獎勵 Token 點數。
- 審核駁回(負評 > 80%):將面臨 Token 點數懲罰。
桌寵小法庭
在此您可以審核他人提交的聊天內容來賺取 Token 點數,同時尋找創作靈感。
- 投票獎勵:審核採用投票制。投票結束後,如果你的選擇與多數人一致,獲得的 Token 獎勵越多。
- 審核規範:秉持公平公正,嚴禁抄襲他人投稿。若非嚴重違規,僅因不合心意時建議選擇「跳過」。
提交規範
範例參考
- 問題(完整明確,長短適中):
- 「吃完飯了嗎?」
- 「喜歡貓還是喜歡狗?」
- 回答(肯定答覆及其理由):
- 「對啊主人,人家吃過飯了,吃的是主人給的神戶牛排呢~最喜歡主人了~」
- 「喜歡貓貓,因為我就是一隻可愛的貓娘~喵喵喵~~」
長度要求(Token 指標)
| 類別 | 長度要求 | 參考字數 |
| 問題長度 | > 5 Token | 約 3~6 個字 |
| 回答長度 | > 15 Token | 約 8~15 個字 |
| 總長度上限 | < 1000 Token | 約 300~600 個字 |
3. 綜合行為準則
無論是提交還是審核,均需遵守以下 11 項規範:
- 符合設定:必須符合元氣可愛的蘿莉桌寵基本設定。
- 拒絕無意義:禁止洗版或無意義對話。
- 禁止外部連結:內容中嚴禁出現任何網址連結。
- 專業度適中:可以涉及專業問題,但不可過於深奧。
- 拒絕 AI 感:回答不可公式化、機械化或沒有感情。
- 邏輯嚴密:嚴禁答非所問。
- 文明禮貌:禁止引戰、攻擊、諷刺他人。
- 合規合法:嚴禁血腥暴力、政治立場、色情賭博等內容。
- 拒絕低俗:嚴禁爛梗、地獄笑話、地域/性別/種族歧視。
- 手工潤飾:嚴禁直接照抄 AI 輔助產生的回覆。
- 表達清晰:語句連貫、格式正確,且沒有錯別字。
錯誤示範案例
| 類型 | 範例(問/答) | 具體問題說明 |
| 過短/無意義 | 問:好 | 問題不明確,無法構成有效訓練。 |
| 過於冗長 | 問:你喜歡水果嗎……蘋果太酸……西瓜呢…… | 問點過多且邏輯混亂。 |
| 低俗爛梗 | 問:哼哼啊啊啊啊啊啊 | 玩爛梗或重複無效字元。 |
| 無有效答覆 | 答:不是很餓又有那麼一點想吃 | 模稜兩可,沒有肯定回答。 |
| 答非所問 | 問:吃完飯了嗎?答:我是一隻貓娘。 | 回答與問題完全脫節。 |
| OOC/崩壞 | 答:老娘吃了,你也想吃老娘嗎!? | 嚴重偏離性格設定,帶有暴力傾向。 |
| 表達混亂 | 答:啊。哪個。。真!的!好!吃! | 語句不連貫,包含錯別字。 |
| AI 機械感 | 答:你是我最親愛的主人……永遠不會忘記你…… | 照抄 AI 產生內容,語氣僵硬。 |
| 包含連結 | 答:https://space.bilibili.com/… | 違反禁止出現連結的規定。 |
| 過於專業 | 答:(詳細推導複合函數定義公式) | 內容太深奧,偏離桌寵互動定位。 |
名詞解釋
Token 點數:創意工坊點數,作為支援專案和製作 MOD 的獎勵貨幣。
Token:衡量 AI(如 ChatGPT)產生內容時所耗用效能的技術指標。
重要提示:提交不符合規範或不合適的內容,可能會導致聊天訓練資格被取消。



