AI & ML interests
None defined yet.
Recent Activity
云碩科技 · xCloudinfo Corp. Limited
自研台灣繁體中文大語言模型 —— 料自產、可驗證、授權自主、資料留在本地。
A Taiwan team building our own Traditional Chinese LLMs — self-sourced & verified data, on-premise, data stays in-house.
關於我們
云碩科技(xCloudinfo Corp. Limited)是位於台灣的 AI 團隊。我們自研台灣繁體中文大語言模型——訓練語料自行蒐集、去識別化、一致性驗證,涵蓋通用繁中與海事、醫療、空拍航空、財經等專業領域;並協助企業把模型部署在自有環境、資料留在內網、可自主維運。此處公開我們自研與優化的模型及其量化版本。
我們做的事
- 自研台灣繁中大語言模型(通用對話 + 領域專業,每個領域獨立訓練)
- 訓練語料自產:自動化蒐集 · 去識別化 · 內容閘門 · 一致性驗證(grounded 接地來源、抑制幻覺)
- 企業內部 / 自架 LLM 部署與維運(資料不離內網)
- 企業知識庫問答(RAG)整合
- GPU 推論環境調校(AMD ROCm / NVIDIA CUDA)
模型發布
台灣繁體中文系列 · xVITA
xVITA = Verified Intelligence · TAiwan(拉丁語 vita「生命」)—— 可驗證的台灣智慧。 自研台灣繁中模型家族:料自產、接地可驗證、授權自主。通用對話 + 領域專業,持續擴充。
領域專業模型
- 海事 Maritime — 航海 / 海軍 / 海運 / 海洋法規 grounded 專業模型(已發布 v1 / v2)
- 醫療 · 空拍航空 · 財經 — 各領域獨立訓練,陸續發布
程式 · xGemable — 繁中友善的程式模型,執行驗證蒸餾 繁中 OCR · Llama-xReadable — 自研繁體中文光學辨識(印刷 / 手寫) 繁中 Embedding · xcloud-emb — 繁中語意檢索嵌入模型(RAG 用) 無審查研究版 · Uncensored — 供資安研究 / 紅隊用途,附責任聲明 GGUF 量化 — 自研與開源模型的 llama.cpp 量化版本,便於地端硬體運行
詳見下方 Collections。
資料產線(我們的底氣)
模型好不好,關鍵在料。我們有一條自動化台灣語料產線:從公開來源自動蒐集 → 去識別化(個資零殘留)→ 雙層內容閘門 → 接地來源、一致性驗證閘門把關 → 才進訓練。政府 / 教育交付級語料每筆可回溯來源、不編造。
技術 · Tech Stack
微調 / 訓練 PyTorch · Transformers · TRL (SFT) · PEFT (LoRA / QLoRA) · Accelerate · bf16 · 知識蒸餾 (Self-Instruct / 自蒸餾) · MoE 逐專家即時反量化 (MXFP4) · 多機分散式訓練 (DDP / NCCL) · OpenCC 簡轉繁
量化 / 格式 llama.cpp · GGUF (k-quant Q4–Q8) · imatrix 校準 · 多模態投影器 mmproj · Abliteration(權重正交化)
推論 / 部署 vLLM · llama-server · Ollama · llama-swap · Ray(跨機張量平行)· Open WebUI · LiteLLM · nginx 負載平衡
平台 / 基礎設施 FastAPI · PostgreSQL · React + Vite + Tailwind · Docker / docker-compose · SSDLC · 自研 xCloudFinetune Studio 視覺化微調平台
算力 / 加速 xCloud 地端 GPU 算力資源池(NVIDIA + AMD 異質機群)· CUDA / ROCm · 單機與多機分散式微調 · 邊緣節點推論
聯絡
官方網站 https://xaitools.xcloudai.com.tw · Email jefflee@cloudinfo.com.tw
模型授權依各自基礎模型之原始授權條款;自研模型授權自主,GGUF 量化版本為重新封裝並標註來源。
-
xCloudinfo/gpt-oss-20b-Code-xCloud
Text Generation • 22B • Updated • 17 -
xCloudinfo/gpt-oss-20b-Code-xCloud-GGUF
Text Generation • 21B • Updated • 495 -
xCloudinfo/xGemable-12B-coder-v1.5-GGUF
Text Generation • 12B • Updated • 900 -
xCloudinfo/xGemable-12B-coder-v2-fullft-GGUF
Text Generation • 12B • Updated • 581
-
xCloudinfo/gpt-oss-20b-Code-xCloud
Text Generation • 22B • Updated • 17 -
xCloudinfo/gpt-oss-20b-Code-xCloud-GGUF
Text Generation • 21B • Updated • 495 -
xCloudinfo/xGemable-12B-coder-v1.5-GGUF
Text Generation • 12B • Updated • 900 -
xCloudinfo/xGemable-12B-coder-v2-fullft-GGUF
Text Generation • 12B • Updated • 581