快速情境範本
基本資訊
公司資訊 必填

描述公司規模、產業別與主要業務

系統用途 必填

描述這套系統要解決的問題與目標

流量規模
使用人數 選填
尖峰併發 選填
每日查詢量 選填

未填時系統依公司規模與用途自動推估

預估每日 Token 量
—
tokens / day
尖峰 RPS 估算
—
req / sec
i Token 即語言模型處理文字的基本單位,中文每字約 1.5–2 個;RPS 為每秒請求數,反映尖峰算力需求。
決策考量因素
資料主權 / 資安法規要求

資料是否有明確不可外流至第三方雲端的規範,會直接影響雲端 vs 地端的首選建議

既有 IT 維運人力 選填
維運人員時薪(NT$)選填

留空則以 NT$1,000/小時 估算

可接受回應延遲(秒)選填
預算上限(NT$)選填
尖峰時段集中程度 選填
未來成長預期 選填
技術設定
預期回答長度
啟用 RAG 知識庫檢索

RAG 讓系統參考公司自有文件庫回答,大幅提升精準度

知識庫規模 選填

未填時系統預設每次檢索消耗 3,000 tokens 上下文

知識庫文件類型 選填
PDF 文件
Word 檔案
網頁內容
資料庫
模型設定
目標模型 選填

填入欲評估部署的語言模型名稱

模型參數量 選填
模型架構 選填
啟用參數量(B) 選填

每個 token 實際參與運算的參數量,決定推理速度。例:GPT-OSS-20B 總參數 21B、啟用 3.6B,速度接近 4B 模型。不確定可留空,系統會依模型名稱推估(可能不夠精準,建議填寫以確保估算準確)。

模型層數 選填

影響 KV Cache 記憶體估算,未填時系統以保守值推估。

權重精度 / 量化格式 選填

請先填寫模型參數量,系統會自動推算權重大小

硬體方案偏好
想評估的地端方案 選填

系統會依你的情境挑選 2~3 個最合適的方案;若已有屬意的硬體,可直接指定。

Ctrl + Enter 快速產生 · 預計等待 30–60 秒

report_preview.png

尚未產生報告

填寫左側表單後點擊「產生評估報告」,系統將輸出包含硬體規格建議、費用估算、架構圖與風險提示的完整評估文件。

流量推估 硬體選型 成本試算 風險提示 Mermaid 圖表

正在分析需求並生成報告

1
解讀需求
2
流量推估
3
架構選型
4
成本計算
5
輸出報告
初始化中... 0%
! 報告生成需要 30–60 秒,系統將依照四段結構逐步分析,請勿關閉或重新整理頁面。
報告已生成
掃描 QR Code 下載報告
請用手機相機或掃碼 App 掃描下方 QR Code
使用說明助理
有任何問題都可以問我