久久亚洲成a人片熟女精品色一区二区三区|国产精品视频第一精品视频|av天堂热无码手机版|亚洲?v无码久久无遮挡|国产精品偷伦视频免费观看国产|麻豆国产自产精品丰满熟妇|av无码av不卡一区二区|久久亚洲精品中文字

ARTICLE DETAIL

資訊詳情

深耕商務(wù)建站與企業(yè)官網(wǎng)運(yùn)營(yíng)的一線實(shí)戰(zhàn)洞察。

本地大模型硬件需求計(jì)算器:從顯存估算到量化選型

本地大模型硬件需求計(jì)算器:從顯存估算到量化選型 很多開發(fā)者在剛接觸本地大模型時(shí)第一個(gè)困擾往往不是“模型怎么調(diào)”而是“我這臺(tái)電腦到底能不能跑起來(lái)”。去社區(qū)問(wèn)了一圈有人用 8GB 顯存跑 7B 模型很流暢有人說(shuō) 16GB 顯存加載就 OOM還有人拿著 4070 問(wèn)能不能微調(diào) 70B。你會(huì)發(fā)現(xiàn)網(wǎng)上關(guān)于本地 LLM 硬件需求的討論幾乎都是零散的個(gè)人經(jīng)驗(yàn)缺少一個(gè)從參數(shù)和公式出發(fā)的量化計(jì)算工具。本文就圍繞“Hardware requirement calculator for local LLMs”這個(gè)主題完整講解本地大模型硬件需求的計(jì)算邏輯并帶你從零實(shí)現(xiàn)一個(gè)可用的硬件需求計(jì)算器。文章會(huì)覆蓋精度格式FP32、FP16、BF16、INT8、INT4對(duì)顯存的影響、KV Cache 的估算方法、推理與訓(xùn)練兩種場(chǎng)景的差異、代碼實(shí)現(xiàn)步驟以及最終如何用計(jì)算結(jié)果指導(dǎo)選卡和配置。適合剛?cè)腴T大模型本地部署的開發(fā)者也適合需要做硬件選型評(píng)估的技術(shù)負(fù)責(zé)人。1. 為什么本地 LLM 需要硬件需求計(jì)算器先說(shuō)一個(gè)常見的現(xiàn)象很多人在決定下載模型之前完全靠“別人說(shuō)能跑”來(lái)做判斷。比如有人看到“7B 模型 Q4 量化只要 4GB 顯存”于是拿著 6GB 顯存的舊顯卡去下載結(jié)果加載到一半進(jìn)程被殺或者生成速度慘不忍睹。還有人在 CPU 上硬跑 70B 模型每個(gè) Token 等好幾秒以為是代碼寫錯(cuò)了其實(shí)是硬件帶寬遠(yuǎn)不達(dá)標(biāo)。要避免這種問(wèn)題最好在下載模型之前就手算出一個(gè)“下限值”這個(gè)模型至少需要多少顯存、多少內(nèi)存推理速度大概會(huì)落在什么區(qū)間。硬件需求計(jì)算器的價(jià)值就在這里。它本質(zhì)上是一個(gè)基于模型參數(shù)、精度格式、上下文長(zhǎng)度、批處理大小等輸入項(xiàng)輸出顯存需求、內(nèi)存需求、推薦硬件檔位的工具。它能幫你解決三個(gè)問(wèn)題我的顯卡夠不夠跑這個(gè)模型如果不夠量化到 INT4 之后夠不夠如果只是跑推理和做微調(diào)相比硬件差距有多大另外本地 LLM 部署并不是簡(jiǎn)單地“模型文件多大就要多少顯存”。模型加載后顯存里除了權(quán)重還有 KV Cache、激活值、CUDA Context 等一系列額外開銷。不考慮這些算出來(lái)的結(jié)果和實(shí)際情況會(huì)有很大偏差。2. 本地 LLM 硬件需求的基礎(chǔ)概念要理解計(jì)算器先要把幾個(gè)核心概念弄清楚。這一節(jié)的內(nèi)容會(huì)比較基礎(chǔ)但它們是后面所有估算公式的根基。2.1 模型參數(shù)量Parameters模型參數(shù)量是衡量 LLM 規(guī)模最直接的指標(biāo)。我們說(shuō)“7B 模型”就是指模型有大約 70 億個(gè)參數(shù)。參數(shù)量直接決定了兩件事模型的學(xué)習(xí)能力和表達(dá)能力模型文件的大小和運(yùn)行時(shí)占用資源。常見模型規(guī)模對(duì)應(yīng)的參數(shù)數(shù)量如下模型規(guī)模參數(shù)量7B約 70 億13B約 130 億33B約 330 億70B約 700 億需要說(shuō)明的是不同模型架構(gòu)在相同參數(shù)量下實(shí)際結(jié)構(gòu)會(huì)有差異比如 LLaMA 和 Mistral 層數(shù)、頭數(shù)都不同。但作為粗略估算參數(shù)量是最通用的起點(diǎn)。2.2 精度格式FP32、FP16、BF16、INT8、INT4同樣一個(gè)模型參數(shù)用多少位來(lái)存儲(chǔ)直接決定模型體積和顯存占用。大模型領(lǐng)域最常見的精度格式有FP3232 位浮點(diǎn)每個(gè)參數(shù)占 4 個(gè)字節(jié)。精度最高范圍最廣但顯存占用也最大?;旧蠜]有人在推理時(shí)用純 FP32 跑大模型更多是在訓(xùn)練時(shí)作為 Master Weight 存在。FP1616 位浮點(diǎn)每個(gè)參數(shù)占 2 個(gè)字節(jié)。精度比 FP32 低但因?yàn)轱@存減半是早期大模型推理的主流格式。它在數(shù)值范圍上有限制|x| 超過(guò) 65504 會(huì)溢出不過(guò)對(duì)推理影響通常不大。BF16BFloat1616 位浮點(diǎn)每個(gè)參數(shù)同樣占 2 個(gè)字節(jié)。BF16 的動(dòng)態(tài)范圍和 FP32 幾乎一樣犧牲了尾數(shù)精度但減少了溢出問(wèn)題。現(xiàn)在主流訓(xùn)練框架都推薦用 BF16因?yàn)榇竽P吞荻热菀壮霈F(xiàn)尺度差異。INT88 位整數(shù)量化每個(gè)參數(shù)占 1 個(gè)字節(jié)。把浮點(diǎn)權(quán)重縮放到整數(shù)范圍來(lái)存儲(chǔ)和計(jì)算顯存直接再減一半。推理時(shí)常用 Weight-Only 量化效果在小模型上會(huì)有所損失但在大模型上表現(xiàn)相當(dāng)好。INT44 位整數(shù)量化每個(gè)參數(shù)理論上只占 0.5 個(gè)字節(jié)。這是社區(qū)最常用的格式比如 GGUF Q4_K_M、GPTQ INT4 等。顯存占用極低但量化誤差相對(duì)更大。對(duì) 7B 模型來(lái)說(shuō)INT4 量化后權(quán)重文件只有 3.5GB 左右很多 4GB 獨(dú)顯的機(jī)器也能跑起來(lái)。為了直觀我把每個(gè)參數(shù)占用的空間整理成表精度每參數(shù)字節(jié)數(shù)7B 模型權(quán)重大小FP324約 28 GBFP16 / BF162約 14 GBINT81約 7 GBINT40.5約 3.5 GB這就是為什么同一個(gè)模型官方通常建議 28GB 顯存但量化到 INT4 只要 4GB 左右就能跑。2.3 KV Cache 與推理開銷很多人只算了權(quán)重顯存忽略了一個(gè)重要部分——KV Cache。在大模型推理時(shí)每生成一個(gè) Token都要把當(dāng)前的 Key 和 Value 緩存下來(lái)供后續(xù) Attention 計(jì)算使用。這部分的顯存占用和輸入輸出長(zhǎng)度成正比也和模型層數(shù)、頭數(shù)、維度有關(guān)。粗略估算公式KV_Cache_Size 2 × num_layers × num_kv_heads × head_dim × seq_len × batch_size × bytes_per_element不過(guò)在實(shí)際工程中我們可以用一個(gè)更簡(jiǎn)單的經(jīng)驗(yàn)值來(lái)估算。通常 KV Cache 大約占模型權(quán)重的 10% 到 30%在長(zhǎng)上下文場(chǎng)景下甚至更高。這也是為什么有人短上下文跑得好好的把 max_length 從 4096 調(diào)到 8192 之后直接 OOM。除了權(quán)重和 KV Cache顯存還需要容納CUDA Context大約 300MB 到 1GB 不等激活值A(chǔ)ctivation和臨時(shí)計(jì)算緩沖輸入 Token 的 Embedding推理框架的額外固定開銷。所以安全的做法是把權(quán)重顯存和 KV Cache 算完之后再額外預(yù)留 1GB 到 2GB 作為緩沖。這也是社區(qū)很多人“按理論算剛好夠?qū)嶋H一跑就爆”的原因——緩沖不夠。2.4 推理與訓(xùn)練的區(qū)別同一塊顯卡跑推理和做微調(diào)完全是兩個(gè)世界。推理只需要保存模型權(quán)重和中間激活梯度不需要保留。所以顯存需求約等于“權(quán)重 KV Cache 額外開銷”。微調(diào)則還要保存梯度梯度和參數(shù)同尺寸、優(yōu)化器狀態(tài)不同優(yōu)化器大小不同、以及更長(zhǎng)的激活鏈。例如用 Adam 優(yōu)化器訓(xùn)練一個(gè) FP16 模型僅優(yōu)化器狀態(tài)就要額外占用 8 字節(jié)/參數(shù)Momentum 和 Variance 各 4 字節(jié)加上梯度的 2 字節(jié)/參數(shù)訓(xùn)練時(shí)單個(gè)參數(shù)的顯存開銷遠(yuǎn)大于推理。近似計(jì)算訓(xùn)練顯存 權(quán)重(2字節(jié)) 梯度(2字節(jié)) Adam狀態(tài)(8字節(jié)) 激活值等 ≈ 每參數(shù) 12 字節(jié)以上也就是說(shuō)FP16 訓(xùn)練一個(gè) 7B 模型光是權(quán)重、梯度和優(yōu)化器狀態(tài)就需要 84GB 左右單靠一張 24GB 顯卡根本裝不下。這也是為什么 LoRA、QLoRA 這類參數(shù)高效微調(diào)會(huì)如此流行——它們把可訓(xùn)練參數(shù)量大幅壓縮從而把訓(xùn)練顯存需求降到普通消費(fèi)級(jí)顯卡能接受的范圍。3. 硬件需求計(jì)算器的核心計(jì)算邏輯理解了上面的概念我們就可以來(lái)設(shè)計(jì)計(jì)算器了。核心就是一組公式根據(jù)用戶輸入的模型參數(shù)、精度和運(yùn)行場(chǎng)景算出顯存和內(nèi)存需求。3.1 權(quán)重顯存計(jì)算公式非常簡(jiǎn)單weight_memory num_params × bytes_per_param例如 7B 模型FP16 精度7,000,000,000 × 2 14,000,000,000 字節(jié) ≈ 14 GBINT4 精度按 0.5 字節(jié)7,000,000,000 × 0.5 3,500,000,000 字節(jié) ≈ 3.5 GB這個(gè)部分是最確定的幾乎不會(huì)因?yàn)檫\(yùn)行環(huán)境不同而變化。3.2 KV Cache 估算嚴(yán)格計(jì)算 KV Cache 需要知道模型具體架構(gòu)但作為通用工具我們可以用模型參數(shù)量的比例來(lái)粗估。這里我用一個(gè)經(jīng)驗(yàn)系數(shù)kv_cache_factor取值范圍通常在 0.1 到 0.3 之間默認(rèn) 0.15。kv_cache_memory weight_memory × kv_cache_factor如果你想更精確一點(diǎn)可以讓用戶輸入層數(shù)、KV Heads、Head Dim 和序列長(zhǎng)度用公式直接計(jì)算。下面計(jì)算器代碼里我會(huì)同時(shí)提供兩種模式快速估算和精細(xì)估算。3.3 推理場(chǎng)景總結(jié)推理所需的總顯存total_vram weight_memory kv_cache_memory overhead其中 overhead 建議至少 1GB如果是 Windows 環(huán)境或者不用 WSL 的話可以再放大一些因?yàn)?Windows 的顯存管理策略不同驅(qū)動(dòng)也會(huì)占一部分顯存。3.4 訓(xùn)練場(chǎng)景適配 LoRA/QLoRA 時(shí)可訓(xùn)練參數(shù)量會(huì)大幅減少。QLoRA 通常只需對(duì)低秩矩陣做梯度計(jì)算所以我們可以用一個(gè)參數(shù)trainable_params_ratio來(lái)表示可訓(xùn)練參數(shù)占全量的比例。training_memory weight_memory weight_memory × (gradient_ratio optimizer_bytes_per_param / bytes_per_element) activated_memory不過(guò)這種精確建模會(huì)很復(fù)雜且不同框架差異大。計(jì)算器里我建議用簡(jiǎn)化模型直接輸出“推理所需顯存”然后按經(jīng)驗(yàn)系數(shù)顯示“全參數(shù)微調(diào)所需顯存約是推理的 5-8 倍”作為警告。對(duì)多數(shù)讀者來(lái)說(shuō)這個(gè)信息量已經(jīng)足夠。3.5 內(nèi)存帶寬與生成速度除了顯存容量還有一個(gè)容易被忽視的硬件參數(shù)——內(nèi)存帶寬。大模型推理屬于“訪存密集型”任務(wù)尤其在低并發(fā)場(chǎng)景下GPU 每生成一個(gè) Token都要把整個(gè)模型權(quán)重從顯存讀一遍。所以理論最大生成速度約等于tokens_per_sec ≈ memory_bandwidth / model_size_in_bytes舉例一塊 4090顯存帶寬約 1008 GB/sFP16 的 7B 模型權(quán)重 14GB理論速度約為1008 / 14 ≈ 72 tokens/s如果是 INT4 量化權(quán)重 3.5GB理論上限約 288 tokens/s不過(guò)實(shí)際還會(huì)受計(jì)算單元限制和其他開銷影響但方向是對(duì)的。所以計(jì)算器也可以輸出一個(gè)預(yù)估生成速度區(qū)間對(duì)用戶體驗(yàn)有很大參考價(jià)值。4. 完整實(shí)戰(zhàn)從零實(shí)現(xiàn)一個(gè) LLM 硬件需求計(jì)算器下面進(jìn)入實(shí)戰(zhàn)環(huán)節(jié)。我會(huì)實(shí)現(xiàn)兩個(gè)版本一個(gè) Python 命令行版本適合快速腳本調(diào)用和二次開發(fā)一個(gè) HTML JavaScript 網(wǎng)頁(yè)版本適合直接雙擊打開使用方便沒有 Python 環(huán)境的同學(xué)。4.1 創(chuàng)建項(xiàng)目結(jié)構(gòu)llm-hw-calculator/ ├── calculator.py ├── index.html └── README.md4.2 Python 命令行版本先實(shí)現(xiàn)核心邏輯。打開calculator.py寫入以下代碼# 文件路徑llm-hw-calculator/calculator.py def bytes_per_param(precision: str) - float: 返回不同精度下每個(gè)參數(shù)占用的字節(jié)數(shù) mapping { fp32: 4.0, fp16: 2.0, bf16: 2.0, int8: 1.0, int4: 0.5, } if precision.lower() not in mapping: raise ValueError(f不支持的精度類型: {precision}可選: {list(mapping.keys())}) return mapping[precision.lower()] def estimate_weight_memory(num_params_billion: float, precision: str) - float: 估算模型權(quán)重的顯存占用單位為 GB num_params num_params_billion * 1e9 return num_params * bytes_per_param(precision) / (1024 ** 3) def estimate_kv_cache_memory(weight_memory_gb: float, seq_len: int, config: dict None) - float: 估算 KV Cache 顯存占用。 如果提供了模型結(jié)構(gòu)參數(shù)則用精細(xì)公式 否則使用經(jīng)驗(yàn)比例粗估。 if config: num_layers config[num_layers] num_kv_heads config[num_kv_heads] head_dim config[head_dim] batch_size config.get(batch_size, 1) # 2 表示 K 和 V 兩份緩存 kv_bytes 2 * num_layers * num_kv_heads * head_dim * seq_len * batch_size * 2.0 return kv_bytes / (1024 ** 3) # 經(jīng)驗(yàn)值KV Cache 約為權(quán)重的 10%~30%這里取 15% return weight_memory_gb * 0.15 def estimate_inference_vram(num_params_billion: float, precision: str, seq_len: int 4096, model_config: dict None) - dict: 估算推理所需顯存和生成速度相關(guān)指標(biāo) weight_mem estimate_weight_memory(num_params_billion, precision) kv_mem estimate_kv_cache_memory(weight_mem, seq_len, model_config) overhead 1.0 # CUDA Context 激活值等固定開銷 total_vram weight_mem kv_mem overhead return { weight_memory_gb: round(weight_mem, 2), kv_cache_memory_gb: round(kv_mem, 2), estimated_overhead_gb: overhead, total_vram_gb: round(total_vram, 2), } def estimate_training_vram(inference_result: dict) - dict: 全參數(shù)微調(diào)粗略估算通常是推理的 5-8 倍 factor_min 5 factor_max 8 return { training_vram_min_gb: round(inference_result[total_vram_gb] * factor_min, 2), training_vram_max_gb: round(inference_result[total_vram_gb] * factor_max, 2), note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 } def estimate_generation_speed(bandwidth_gb_per_s: float, num_params_billion: float, precision: str) - float: 理論最大生成速度tokens/s只考慮權(quán)重復(fù)讀耗時(shí) model_size_gb estimate_weight_memory(num_params_billion, precision) if model_size_gb 0: return 0.0 return round(bandwidth_gb_per_s / model_size_gb, 2) if __name__ __main__: # 例子7B 模型INT4 量化上下文 4096在 4090 上推理 example_vram estimate_inference_vram( num_params_billion7.0, precisionint4, seq_len4096 ) print( 推理顯存估算 ) for key, value in example_vram.items(): print(f{key}: {value} GB) print(\n 微調(diào)顯存估算 ) training_info estimate_training_vram(example_vram) for key, value in training_info.items(): print(f{key}: {value}) print(\n 生成速度粗算RTX 4090 約 1008 GB/s ) speed estimate_generation_speed( bandwidth_gb_per_s1008, num_params_billion7.0, precisionint4 ) print(f理論最大生成速度約: {speed} tokens/s)這段代碼的核心就是幾個(gè)純函數(shù)輸入輸出都很清晰。逐個(gè)解釋bytes_per_param精度映射表INT4 返回 0.5 字節(jié)。estimate_weight_memory權(quán)重顯存。estimate_kv_cache_memory優(yōu)先用精細(xì)公式缺少架構(gòu)參數(shù)時(shí)退回經(jīng)驗(yàn)比例。estimate_inference_vram匯總。overhead 固定 1GB這個(gè)值你可以根據(jù)自己的環(huán)境調(diào)整Windows 下建議 1.5GB。estimate_training_vram給出全參數(shù)微調(diào)的粗估區(qū)間。estimate_generation_speed理論最大速度強(qiáng)調(diào)“理論”因?yàn)閷?shí)際要打折扣。運(yùn)行結(jié)果類似 推理顯存估算 weight_memory_gb: 3.5 GB kv_cache_memory_gb: 0.52 GB estimated_overhead_gb: 1 GB total_vram_gb: 5.02 GB 微調(diào)顯存估算 training_vram_min_gb: 25.12 GB training_vram_max_gb: 40.19 GB note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 生成速度粗算RTX 4090 約 1008 GB/s 理論最大生成速度約: 288.0 tokens/s如果你用 FP16 跑同一個(gè) 7B 模型weight_memory_gb: 14.0 GB kv_cache_memory_gb: 2.1 GB estimated_overhead_gb: 1 GB total_vram_gb: 17.1 GB同樣是 7B 模型FP16 和 INT4 的總顯存差了 12GB 左右。這就是量化對(duì)本地部署的意義。4.3 支持模型結(jié)構(gòu)參數(shù)的精細(xì)模式上面的estimate_kv_cache_memory已經(jīng)預(yù)留了config參數(shù)。如果你想在計(jì)算器中嵌入某個(gè)具體模型的結(jié)構(gòu)信息可以這樣用。這里以 LLaMA-7B 為例llama_7b_config { num_layers: 32, num_kv_heads: 32, head_dim: 128, batch_size: 1, } # 在 seq_len4096 時(shí)KV Cache 約為 1.0 GB kv_cache estimate_kv_cache_memory( weight_memory_gb14.0, seq_len4096, configllama_7b_config ) print(f精細(xì)模式 KV Cache: {kv_cache:.2f} GB)實(shí)際上不同模型架構(gòu)的 KV Cache 計(jì)算方式逐步演進(jìn)。像 GQAGrouped Query Attention在 LLaMA 2 70B 中出現(xiàn)后KV Head 數(shù)量遠(yuǎn)小于 Query Head 數(shù)量KV Cache 會(huì)更小。這也是為什么部分大模型在長(zhǎng)上下文場(chǎng)景下尤其依賴 GQA。你的計(jì)算器如果有模型庫(kù)把這些參數(shù)配置成 JSON 是不錯(cuò)的選擇。4.4 HTML 網(wǎng)頁(yè)版本為了讓沒有 Python 環(huán)境的同學(xué)也能用我把同樣的邏輯做成一個(gè)純前端頁(yè)面。打開index.html寫入以下代碼!DOCTYPE html html langzh-CN head meta charsetUTF-8 meta nameviewport contentwidthdevice-width, initial-scale1.0 title本地 LLM 硬件需求計(jì)算器/title style body { font-family: -apple-system, BlinkMacSystemFont, Segoe UI, sans-serif; max-width: 720px; margin: 0 auto; padding: 20px; background: #f7f8fa; color: #333; } .card { background: #fff; border-radius: 12px; padding: 24px; margin-bottom: 16px; box-shadow: 0 2px 8px rgba(0, 0, 0, 0.06); } h1 { font-size: 1.5rem; } label { display: block; font-weight: 600; margin-bottom: 6px; } select, input { width: 100%; padding: 10px; margin-bottom: 16px; border: 1px solid #ddd; border-radius: 8px; font-size: 1rem; box-sizing: border-box; } button { background: #1677ff; color: #fff; border: none; padding: 12px 24px; border-radius: 8px; font-size: 1.05rem; cursor: pointer; } button:hover { background: #0958d9; } .result-item { display: flex; justify-content: space-between; padding: 8px 0; border-bottom: 1px solid #f0f0f0; } .result-item:last-child { border-bottom: none; } .warn { background: #fffbe6; border: 1px solid #ffe58f; border-radius: 8px; padding: 12px; margin-top: 12px; font-size: 0.9rem; } /style /head body div classcard h1本地 LLM 硬件需求計(jì)算器/h1 p根據(jù)模型參數(shù)、精度、上下文長(zhǎng)度估算推理所需顯存、微調(diào)顯存范圍和理論生成速度。/p /div div classcard label formodelSize模型參數(shù)量B/label input typenumber idmodelSize value7 step0.1 min0.1 label forprecision精度格式/label select idprecision option valuefp32FP324 字節(jié)/參數(shù)/option option valuefp16 selectedFP162 字節(jié)/參數(shù)/option option valuebf16BF162 字節(jié)/參數(shù)/option option valueint8INT81 字節(jié)/參數(shù)/option option valueint4INT40.5 字節(jié)/參數(shù)/option /select label forseqLen上下文長(zhǎng)度Tokens/label input typenumber idseqLen value4096 step512 min512 label forbandwidthGPU 顯存帶寬GB/s/label input typenumber idbandwidth value1008 step50 min50 button onclickcalculate()計(jì)算硬件需求/button /div div classcard idresult styledisplay:none; h2推理顯存估算/h2 div idinferenceResult/div h2微調(diào)顯存估算/h2 div idtrainingResult/div h2理論生成速度/h2 div idspeedResult/div div classwarn idwarning/div /div script const PRECISION_BYTES { fp32: 4.0, fp16: 2.0, bf16: 2.0, int8: 1.0, int4: 0.5, }; function calculate() { const modelSizeB parseFloat(document.getElementById(modelSize).value); const precision document.getElementById(precision).value; const seqLen parseInt(document.getElementById(seqLen).value); const bandwidth parseFloat(document.getElementById(bandwidth).value); if (!modelSizeB || modelSizeB 0) { alert(請(qǐng)?zhí)顚懩P蛥?shù)量); return; } const bytesPerParam PRECISION_BYTES[precision]; const numParams modelSizeB * 1e9; const weightBytes numParams * bytesPerParam; const weightGB weightBytes / (1024 ** 3); // KV Cache 粗估權(quán)重 15% const kvGB weightGB * 0.15; // 固定開銷 const overheadGB 1.0; const totalVRAM weightGB kvGB overheadGB; const trainMin totalVRAM * 5; const trainMax totalVRAM * 8; // 理論速度 const theoreticalSpeed bandwidth / weightGB; document.getElementById(inferenceResult).innerHTML div classresult-itemspan模型權(quán)重/spanspan${weightGB.toFixed(2)} GB/span/div div classresult-itemspanKV Cache估算/spanspan${kvGB.toFixed(2)} GB/span/div div classresult-itemspan固定開銷CUDA Context 等/spanspan${overheadGB.toFixed(2)} GB/span/div div classresult-item stylefont-weight:700;span推薦顯存下限/spanspan${totalVRAM.toFixed(2)} GB/span/div ; document.getElementById(trainingResult).innerHTML div classresult-itemspan全參數(shù)微調(diào)估算/spanspan${trainMin.toFixed(2)} ~ ${trainMax.toFixed(2)} GB/span/div ; document.getElementById(speedResult).innerHTML div classresult-itemspan理論最大生成速度/spanspan${theoreticalSpeed.toFixed(2)} tokens/s/span/div div classresult-itemspan實(shí)際體驗(yàn)參考/spanspan約 ${(theoreticalSpeed * 0.4).toFixed(2)} ~ ${(theoreticalSpeed * 0.7).toFixed(2)} tokens/s/span/div ; let warnText ; if (totalVRAM 24) { warnText 推薦顯存超過(guò) 24GB常見消費(fèi)級(jí)顯卡較難滿足。建議嘗試更大量化如 INT4或選擇更小模型也可以考慮云 GPU 實(shí)例。; } else if (totalVRAM 12) { warnText 推薦顯存超過(guò) 12GB建議確認(rèn)你的顯卡顯存是否足夠。若不足可以改用 INT4/INT8 量化并縮短上下文長(zhǎng)度。; } else { warnText 當(dāng)前配置在主流 8GB~24GB 顯卡上都有機(jī)會(huì)運(yùn)行。具體流暢度還要看內(nèi)存帶寬和系統(tǒng)顯存共享策略。; } document.getElementById(warning).innerText warnText; document.getElementById(result).style.display block; } /script /body /html這個(gè)頁(yè)面就是一個(gè)完整的計(jì)算器。用瀏覽器打開后輸入模型參數(shù)量選擇精度格式設(shè)置上下文長(zhǎng)度填顯卡顯存帶寬點(diǎn)擊按鈕就能得到結(jié)果。頁(yè)面里我另外加了一個(gè)“實(shí)際體驗(yàn)參考”取理論速度的 40% 到 70%這是考慮到 Attention 計(jì)算、采樣、接口傳輸?shù)拈_銷。這個(gè)比例不是精確值但比直接報(bào)理論速度更貼近真實(shí)體驗(yàn)。4.5 運(yùn)行與驗(yàn)證Python 版本運(yùn)行方式cd llm-hw-calculator python calculator.py如果看到類似下面的輸出說(shuō)明代碼運(yùn)行正常 推理顯存估算 weight_memory_gb: 3.5 GB kv_cache_memory_gb: 0.52 GB estimated_overhead_gb: 1 GB total_vram_gb: 5.02 GB 微調(diào)顯存估算 training_vram_min_gb: 25.12 GB training_vram_max_gb: 40.19 GB note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 生成速度粗算RTX 4090 約 1008 GB/s 理論最大生成速度約: 288.0 tokens/s網(wǎng)頁(yè)版本直接用瀏覽器打開index.html即可不需要起服務(wù)也不需要聯(lián)網(wǎng)。4.6 結(jié)果解讀建議拿到計(jì)算結(jié)果后不要直接拿“推薦顯存下限”去對(duì)標(biāo)顯卡。我的建議是如果推薦顯存略小于你的顯卡顯存比如差了 1GB可以跑但盡量縮短上下文長(zhǎng)度同時(shí)關(guān)掉其他占用顯存的應(yīng)用。如果推薦顯存和顯卡顯存差不多建議使用 GGUF 的 k-quant 系列量化或調(diào)整 KV Cache 策略。如果要長(zhǎng)時(shí)間運(yùn)行服務(wù)要預(yù)留比計(jì)算值多 2GB 左右的余量因?yàn)橄到y(tǒng)和服務(wù)端框架會(huì)隨時(shí)間產(chǎn)生一些顯存碎片。5. 常見問(wèn)題與排查思路開發(fā)和實(shí)際部署過(guò)程中很多人會(huì)遇到類似的問(wèn)題。我整理成了一份表格方便你查閱。問(wèn)題現(xiàn)象常見原因解決思路加載模型時(shí)直接 OOM顯存需求超過(guò)顯卡容量或者上下文長(zhǎng)度設(shè)置過(guò)大計(jì)算器先算一次改用 INT4/INT8 量化縮短上下文長(zhǎng)度加載成功但生成速度極慢內(nèi)存帶寬不足或權(quán)重未完全載入顯存而使用共享內(nèi)存檢查nvidia-smi確認(rèn)模型確實(shí)在顯存降低 KV Cache 或分批量化Windows 下 OOM同樣顯存 Linux 卻可以Windows 顯存管理策略和驅(qū)動(dòng)占用量不同適當(dāng)調(diào)大 overhead 值或使用 WSL2 運(yùn)行短上下文正常長(zhǎng)上下文卡死KV Cache 隨序列長(zhǎng)度線性增長(zhǎng)導(dǎo)致顯存溢出在 Framework 層面限制 max_length或使用支持 PagedAttention 的推理框架計(jì)算器說(shuō)夠?qū)嶋H跑起來(lái)差一點(diǎn)忘記算 CUDA Context、驅(qū)動(dòng)占用、框架緩沖把 overhead 從 1GB 調(diào)到 1.5GB 再到 2GB 重新估算換量化格式后速度沒有明顯提升模型已經(jīng)變小但 Attention 計(jì)算占了主要耗時(shí)檢查是否滿足帶寬受限假設(shè)短序列下影響可能不大用 CPU 推理速度慢到不可用CPU 內(nèi)存帶寬遠(yuǎn)低于 GPU優(yōu)先用量化模型核數(shù)多少不是決定推理速度的唯一因素內(nèi)存帶寬更關(guān)鍵幾個(gè)排查步驟值得展開說(shuō)。5.1 驗(yàn)證顯存占用在模型加載后打開另一個(gè)終端運(yùn)行nvidia-smi觀察四塊區(qū)域GPU 顯存 Used進(jìn)程列表中 Python / llama-server 進(jìn)程的顯存Volatile GPU-Util如果是多卡確認(rèn)模型是否只用了其中一張。如果nvidia-smi顯示的 Used 顯存和計(jì)算器估算差別很大通常是因?yàn)槟阌玫哪P筒皇怯?jì)算器對(duì)應(yīng)精度的版本推理框架有額外的顯存優(yōu)化如 KV Cache 重用或者上下文長(zhǎng)度設(shè)置和設(shè)備上的max_seq_len不一致。5.2 是否真的把所有模型權(quán)存放進(jìn)了顯存有些推理框架在顯存不足時(shí)會(huì)自動(dòng)把部分權(quán)重放到內(nèi)存。從性能角度看這種模式雖然在短時(shí)間能運(yùn)行但每層之間都有 PCIe 或共享內(nèi)存的傳輸速度會(huì)嚴(yán)重退化。你可以用nvidia-smi看 CUDA Memory 的分配情況或者在日志里看框架是否打印出類似 “offload to CPU” 的信息模型文件是否被 mmap 映射到了內(nèi)存。如果確認(rèn)有 offload最直接的解決辦法是減小模型或用更高程度量化。5.3 訓(xùn)練顯存不夠時(shí)怎么辦如果你做的不是推理而是微調(diào)顯存不夠時(shí)優(yōu)先考慮LoRA只訓(xùn)練注入的低秩矩陣顯存開銷小很多QLoRA加載的模型先量化到 INT4再訓(xùn)練低秩適配器梯度累積不用一次性把 batch 都放進(jìn)顯存混合精度BF16 或 FP16 訓(xùn)練減少一半顯存梯度檢查點(diǎn)用時(shí)間換空間。你會(huì)發(fā)現(xiàn)推理場(chǎng)景的“量化”在訓(xùn)練場(chǎng)景里同樣有效而且 QLoRA 是當(dāng)前社區(qū)最熱門的低成本全參微調(diào)替代方案。如果你的模型是 70B 級(jí)別QLoRA 配合兩張 24GB 顯卡是可行的但全參數(shù)微調(diào)則可能需要多塊 A100 或 H100。6. 最佳實(shí)踐與工程建議這一節(jié)是本文最有工程價(jià)值的部分建議結(jié)合自己的使用場(chǎng)景去對(duì)照。6.1 計(jì)算器參數(shù)本身要?jiǎng)討B(tài)調(diào)整不要死守默認(rèn)參數(shù)。比如KV Cache 經(jīng)驗(yàn)系數(shù) 0.15 只適合中等上下文2048~4096。如果上下文是 8192 或 16384系數(shù)應(yīng)上調(diào)到 0.25 甚至 0.35。overhead 1GB 是最小值。生產(chǎn)環(huán)境建議 2GBWindows 建議 1.5~2GB。帶寬不是唯一瓶頸。如果你用的是 4090權(quán)重訪存確實(shí)主導(dǎo)如果模型比較小如 1B 到 3B計(jì)算密集型操作可能成為瓶頸實(shí)際速度會(huì)比理論值低更多。6.2 量化精度選擇的原則選擇量化精度時(shí)不能一味“越低越好”。我的建議7B 模型如果顯存有 8GB優(yōu)先 Q8/Q6效果和 FP16 差距很小如果顯存只有 4GB才考慮 Q4。13B 模型Q5/Q6 是甜點(diǎn)量化效果和 FP16 接近顯存需求又在可控范圍內(nèi)。70B 級(jí)別Q4 是唯一可行選擇。但如果模型對(duì)輸出質(zhì)量要求高可以試試 Q4_K_M 和 Q4_K_S 之間的差異。生成長(zhǎng)文本、代碼任務(wù)時(shí)量化損失會(huì)更明顯尤其是復(fù)雜邏輯和多步推理場(chǎng)景。如果是簡(jiǎn)單問(wèn)答、摘要INT4 的差距更容易接受。6.3 選型時(shí)不要只看顯存容量很多人在選顯卡時(shí)只看顯存忽略了帶寬和算力。其實(shí)對(duì)于本地 LLM 推理顯存帶寬的作用比很多人想象中大得多。以 7B FP16 模型為例顯卡顯存帶寬理論最大速度RTX 3060360 GB/s約 25 tokens/sRTX 4070504 GB/s約 36 tokens/sRTX 40901008 GB/s約 72 tokens/sM2 Ultra800 GB/s約 57 tokens/s注意這只是權(quán)重讀取的理論速度實(shí)際會(huì)更低但橫向?qū)Ρ仁强煽康膸挿独碚撍俣壬舷抟卜丁R虼巳绻愕闹饕猛臼潜镜卮竽P驮跐M足顯存容量的前提下盡量選帶寬更高的顯卡這一步比一味堆顯存更實(shí)際。6.4 生產(chǎn)環(huán)境建議如果你要把本地 LLM 做成服務(wù)給團(tuán)隊(duì)使用除了顯存計(jì)算還要注意并發(fā)請(qǐng)求數(shù)并發(fā)增加會(huì)擴(kuò)大 KV Cache 總和計(jì)算器里的 batch_size 要乘以并發(fā)數(shù)顯存泄漏長(zhǎng)時(shí)間運(yùn)行的服務(wù)建議定期監(jiān)控nvidia-smi --query-gpumemory.used --formatcsv發(fā)布前做壓力測(cè)試模型熱加載切換模型時(shí)如果顯存沒釋放可以先 kill 進(jìn)程再重新啟動(dòng)多用戶隔離盡量用支持 PagedAttention 的推理框架如 vLLM能更高效管理 KV Cache日志與監(jiān)控在容器或 systemd 服務(wù)中記錄顯存峰值方便后面調(diào)參。6.5 謹(jǐn)慎處理存儲(chǔ)與下載一個(gè)經(jīng)常被忽略的事實(shí)是模型文件下載后占用的是磁盤空間。如果做量化轉(zhuǎn)換中途還要存放未量化模型。例如 70B FP16 模型原始文件 140GB量化過(guò)程可能需要額外 140GB 臨時(shí)空間。所以磁盤最少要有模型文件大小的 2 倍空間再做量化轉(zhuǎn)換優(yōu)先使用 SSD因?yàn)榧虞d模型時(shí)有大量隨機(jī)讀取如果從 Hugging Face 下載提前配置好緩存路徑避免把系統(tǒng)盤占滿。6.6 用計(jì)算器輔助自動(dòng)決策如果你是運(yùn)維或平臺(tái)開發(fā)計(jì)算器邏輯還可以嵌入部署腳本。比如用戶選擇模型和精度后腳本自動(dòng)判斷當(dāng)前 GPU 可用顯存是否滿足不滿足就拒絕啟動(dòng)或者在啟動(dòng)時(shí)自動(dòng)切到更低的量化格式。這種做法雖然簡(jiǎn)單但能避免很多“部署后崩掉”的問(wèn)題。7. 擴(kuò)展方向與下一步學(xué)習(xí)路線本文實(shí)現(xiàn)的計(jì)算器核心邏輯已經(jīng)能覆蓋絕大多數(shù)本地 LLM 硬件評(píng)估場(chǎng)景但還有幾個(gè)方向可以繼續(xù)完善。7.1 接入更多推理框架參數(shù)不同推理框架的顯存行為差異很大llama.cpp / GGUF有 mmap可以通過(guò)--n-gpu-layers控制多少層放到 GPUvLLM有 PagedAttentionKV Cache 可以動(dòng)態(tài)劃分Hugging Face Transformers默認(rèn)行為是把所有參數(shù)加載到指定設(shè)備ExLlamaV2專門針對(duì)量化模型優(yōu)化顯存占用和速度表現(xiàn)都更理想。你的計(jì)算器可以在輸出里增加“不同框架推薦參數(shù)”這是很有價(jià)值的信息。7.2 引入模型結(jié)構(gòu)數(shù)據(jù)庫(kù)如果計(jì)算器能內(nèi)置常見模型的架構(gòu)信息層數(shù)、頭數(shù)、維度、KV Head 數(shù)KV Cache 估算精度會(huì)大幅提升。這部分?jǐn)?shù)據(jù)可以直接從模型目錄的config.json里獲取。{ hidden_size: 4096, intermediate_size: 11008, num_attention_heads: 32, num_hidden_layers: 32, num_key_value_heads: 32 }讀取這些字段后代入精細(xì)公式KV Cache 計(jì)算就會(huì)比經(jīng)驗(yàn)比例準(zhǔn)確得多。7.3 從靜態(tài)計(jì)算到動(dòng)態(tài)監(jiān)控更進(jìn)一步計(jì)算器可以不做成“一次性估算工具”而是做成“部署后監(jiān)控面板”。部署模型時(shí)記錄初始顯存運(yùn)行過(guò)程實(shí)時(shí)記錄顯存峰值和 Token 速度再用這些數(shù)據(jù)回填優(yōu)化估算模型。這種思路適用于企業(yè)內(nèi)部的 LLM 服務(wù)運(yùn)維平臺(tái)能逐步建立更貼近自己的硬件選型基線。7.4 加上成本模型如果你考慮云 GPU 實(shí)例建議在計(jì)算器里同時(shí)引入“按需價(jià)格”維度。例如 24GB A10G 和 48GB A6000 的價(jià)格差、性能和顯存的關(guān)系做成簡(jiǎn)單的性價(jià)比指標(biāo)。這樣同一個(gè)模型你不僅知道需要什么硬件還能知道用哪類實(shí)例更劃算。8. 寫在最后本地 LLM 部署的“硬件夠不夠”這個(gè)問(wèn)題其實(shí)完全可以量化不需要賭運(yùn)氣。通過(guò)精度、參數(shù)量、KV Cache 和帶寬這幾個(gè)核心參數(shù)你就能在下載模型前對(duì)顯存需求、生成速度和訓(xùn)練可行性心里有數(shù)。本文實(shí)現(xiàn)的硬件需求計(jì)算器無(wú)論是 Python 腳本還是網(wǎng)頁(yè)版本都保持了極低的依賴和較高的可移植性你可以直接復(fù)制到自己的項(xiàng)目中用。在實(shí)際使用中我建議你把“計(jì)算器估算值 實(shí)際 nvidia-smi 觀察值 生成速度實(shí)測(cè)值”三份數(shù)據(jù)放在一起對(duì)比。很快你就會(huì)發(fā)現(xiàn)顯存需求不再是個(gè)模糊概念而是能用公式推演、用監(jiān)控驗(yàn)證的工程指標(biāo)。如果你正在部署本地模型不妨先用這個(gè)計(jì)算器跑一遍再?zèng)Q定下載哪個(gè)量化版本。要知道在 8GB 顯卡上硬上 FP16 的 13B 模型和用 Q4 量化版跑流暢對(duì)話體驗(yàn)完全是兩個(gè)層次。選對(duì)硬件和精度可能比多花半個(gè)月調(diào)參更有效果。
返回列表
PREV
查看更多資訊
NEXT
返回資訊列表
人妻9117c| 久啪视频| 超碰av在线| 加勒比日本在线| 丝袜美腿亚洲| 嗯嗯啊操我| 人妻少妇精品无码专区二区密桃| 青青久久手机线视频| 欧美综合色站| 久久久久人| 国产免费一区二区三区最新不卡| 骚妻少妇精品性色无码四色A V| 国产精品com| www.99热| 久久受www免费人成| 欧美综合色站| 尹人免费观看视频在线| 国产男女无套97| 天天视频黄| 激情文学欧美| 国产成人免费观看在线视频| 蜜桃传媒视频第一区入口在线看| 欧美婷婷| 日本淫乱女一区二区三区视频| 国产最新AV| 亚洲色宗合| 伊人精品久久网站| 欧美日韩亚洲天堂| 伊人网在线观看| 香蕉黄色一级视频| 欧 美 自 拍 偷 拍| 国产91美女视频| 欧美黑人91| 91精品免费| 97丝袜亚洲在线播放| 99爱久久视频频| 久久久工口| 黑丝少妇| 亚洲日韩久久精品一区| 日韩小电影| 久久精品黄色| 欧美性爱一区二区| 狠狠爱综合网| 欧美日韩m| 少妇毛片久久| 九九九久| 日日夜夜精品视频| 无码国产Av| 国产精品制服丝袜清纯唯美| 91干熟女| 91 手机在线播放 绯色| 91嫩草欧美| 熟女网站最新| 亚洲欧美国产精品久久久久久久| 久久精品| 日本欧美一区二区三区视频麻豆| 九九久久一区二区伦理| 日本中文字幕在线视频| 97资源超碰| 韩日男人的天堂| 久久 亚洲 日韩 人妻| 亚洲限制级| www.AV有限公司一区| 日欧毛片久久| 欧美丝袜91| juliaann欧美丝袜办公室| 青青在线视频日韩欧美| 日韩国产欧美伦理在线| 婷婷丁香熟妇综合网| 一品道视频一区二区三区| 亚洲日本韩国极品一区二区| 天天天堂影视日韩亚洲91| 好吊爽好吊爽在线视频,中文字幕精品一区二区日本,国产良妇出轨视频在线观看, | 老熟妇一区二区三区…| 人妻精品视频一区二区| 在线天堂999| 97超碰精品成| 久久久亚洲| 蜜乳Av成人片网站| 青青操日韩| 91色色网站| 牛黄色久午久| 亚洲情色图片区| 97综合激情| 亚洲AV麻豆Aⅴ无码电影一| 人人摸人人添人人操| 精品人妻伦一二三区久久| AV天堂男人的天堂| 九九九九九精品视频| a一区二区三区乱码在线| 国产精品自产拍在线观看社区| 精品超碰中文在线| 亚洲视频精选| 91精品综合久久久久久五月丁香| 久久久久人| 人人操人人操人人人操| 欧美大香蕉在线观看| 成人开心网在线视频| 亚洲 小说 欧美 激情 另类| 久久久婷婷| 超碰97在线色男人??| 亚洲人成在线放东京热| 99视频内射三四| 91熟女少妇| av强奸乱轮| 一区=区三区视频| 不卡视频一区蜜桃视频| 久久九九网| 欧美青青草视频| 亚洲性爱成人| 粉嫩久久久久| 日本操色导航| 超碰久在线天天做| 神马久久久久久伦理片| 91九色丰满高潮| 免费精品人妻一区二区三| 九月丁香婷婷| 国产日韩精品无码去免费专区国产| 丁香六月天| 欧美天天弄| 亚洲精品一区中文字幕乱码| 97在线观看| 青娱乐亚洲热| 嗯啊视频免费在线观看| 97色插| 欧美综合另类| 91色碰| 欧美+日产+中文| 亚洲欧美大| 一中国女人毛片水真多| 亚洲AV高潮| 97干在线| 思思热国产高清| 骚乳在线| 国产女人和拘做爰视频 | 欧美激情亚洲情色| 久久精品美女一区| 最新亚洲黄色免费电影| caopeng97人妻| 岛国片国产成人亚洲播放| 少妇精品久久久| 成年人一级黄色毛片大全在线观看| 人人操人人射人人干| 欧美黄片欧美黄片xxx| 国产人妻精品一区二区三区秋霞| www九九热| 国产女同在线观看视频| 天天操熟妇| 亚洲有薄码区日本系列中文字幕| 日本一区视频在线观看| 日韩欧美~中文字| 色月天AV导航| 国产成人久久久精品免费AV| AⅤ片水多多| 国产精品久久久久久夜夜夜夜| 亚欧高清在线| 在线视频97| 九九九九九九视频| 国产最新AV| 久久久久久久久久va| 肉丝无码中文高清| 999日韩中文精品观看视频。| 欧美伊人久久综合网| 日韩精品系列| 97亚洲综合电影| 色黄色美女大长腿午夜视频| 欧美性天天| 中文子幕一二三| 超碰日本97美女人妻人人玩人人爱| 丁香五六月啪啪| 亚洲AV色图一区| 99国内精品| 大香蕉黄色一区| 伊人久久综合影院精品久久久 | 久久久99免费| 立川理惠被中出无码| 国产深喉| 久久一二三四五六七八九区区| 国产树林里野战在线看| 国产剧情一区在线观看| 国产三级中文有码在线视频| 日本操逼视频在线| 激情小说亚洲| 欧美激情精品| 人妻少妇精品无码专区二区密桃| 国产美女激情| 人人摸人人干| 人人色人人射人人妻| 国内精品久久久久影院亚洲| 国产区91柔拿会所技师| 中文字幕精品一区欧美| 国产在线视频二区| 日韩有码 一区二区三区| 亚洲欧美在线丝袜| 亚洲资源一区| 亚洲天堂男人天堂网| 国产丁香精品露脸视频| 福利五区| 久9综合在线| 天堂亚洲精品久久老牛| 少好三P| 欧美少妇性乱| 国产一| 欧美91久久久久| 亚洲大胆人体av| 日韩99神马视频片| 午夜精品久久久久久久99热影院 | 强奸乱伦免费网站| 91久久免费视频互動交流| 97干色| 色姑娘综合网| 久久久久久久免费A片国产成a人亚洲精∨品无码 | 极品欧美一区二区三区| 人人操人人色人人摸| 欧差乱伦二三| 亚洲无无码αⅴ每日更新| 成人自拍三级在线观看| 午夜.DJ高清在线观看免费7| 2019天天干天天操| www超碰| 五月色综合| 伊人天堂在线| 欧美精品 - 91爱爱| 嫩草伊人久久精品| 亚洲自拍青操视频| 欧亚日韩一区在线| 最新av中文字幕高清| 中国一级特黄大片护士| 久久亚洲AV成人精品无码| 国产精品自在线发布| 色狠狠综合| 极品五月天噜噜| av情色影音| 欧美国产操逼| 啊啊啊爽爽| 国产家庭乱伦表演| 综合激情五月丁香| 欧美一区二区情色| 琪琪精品免费一区二区三区| 久久久久久人妻一区精品色欧美| 午夜男人一级A片7777| 偷拍 精品另类 凸凹了四区| 青青草日韩免费观看高清在线| 99精品在线| 欧美资源| 亚洲精品无码少妇久久| 人妻天天爽夜夜爽精品2| 欧美在线 亚洲| 精品人妻15区| 日韩精品亚洲专区在线影视| 欧美色九九九| 国产h小视频在线观看免费| 国产精品福利视频播放| 婷婷五月天伊人| 日韩午夜国产| 97国产超碰| 一区二区三区黄片免费观看| 精品久久久久久久久久久久 | 久综合网| 日本三级韩国三级美三级91| 超碰97欧美| 在线观看色视频| www.狠狠干.coom | 92人人操人人| 久久久性爱视频| 伊人欧美大香蕉视频| 伊人丁香五月婷婷| 五月天开心网| 久久色AV线| 色吧5亚洲| www.狠狠干.coom | 91熟女丨老女人| 国产Aα| 欧美美女自慰一区二区三区| 精品国产乱码久久久久久久久久毛片| 高清一区AV无码| 天天综合日韩网| 精品熟妇视频一区二区| 色色色天美视频| 亚州 综合 色图| 日韩精品字幕| 亚洲人成色9999精品久久| 97超碰超| 五月婷视频| 蜜区区视频79| 亚洲激情av| 欧美日韩精品青青| 久久一区二区三区入口| 黄色交缠性感爆操91国产精品免费一区二区三区| 亚洲97成人在线观看| 人人操AV| 人、人、摸,人、人、草| 99亚洲人人| 97超碰精品| 色性欧美| 精品欧美不卡在线播放| 久久伊人在线五区| 日韩无码精品综合久久| 精品一区二区三区四区女 | 日日夜夜骚| 2025年A片视频精品| 冬京热男人的天堂| 国产精品毛片?v一区二区三区| 久久这里精品国产99丫e6| 好爽视频在线观看视频| 97网址www| 人人操人人干xxx| 大香蕉综合| 久久欲| 国产不卡中文字幕免费avi| 日本成人A片免费看| 99啪啪| 亚洲免费成人在线高清无码视频| 久久精品视| 久久久夜夜嗨免费视频| 欧美不卡五十路| 亚洲大色堂| 郑州宾馆老熟女露脸啪啪| 97国产精选| 操少妇很爽av| 中文字幕亚洲热播人妻| 校园春色第一页| 日本亚洲vr欧美不卡高清专区| 国产精品直播在线观看直播| 国产成人精品午夜福利| 骚乳在线| 黄色一级视| 久久99国产精品| 10000部十八禁看电影| 成人性爱全视频观看| 这里只有精品97| 4141514逼喷水三级片| 国产人妖的免费的视频| 欧美黄页| 亚洲AV不卡在线观看| 五月婷婷深深爱| 在线观看一级α片刺激高潮视频| 久久精品一区二区三区蜜桃臀| 亚洲人妻av| 极品欧美一区二区三区| 久久久天堂| 少妇人妻精品| 日本一本一区二区三区四区五区欧美日韩中文字幕 | 亚洲日韩电影| 中文字幕av片| 中文字幕久久精视频久久大全| 十八禁啪啦拍视频无遮挡| 国产视频人人网| 少妇精品久久久八区九区| 日本少妇va7777| 国产伦精品一区二区三区在线观| 久久成人国产精品| 影音先锋每日最新资源在线观看| 欧美色图另类图片| 超碰在97| 精品国产72| 亚洲天堂中文字幕无码男同| 欧美日韩婷婷中文| 九九黄色网| 狠狠色噜噜狠狠狠狠狠色综合久久| 国产传媒一区二区三区| 97ai亚洲| 激情文学亚洲| 91超碰丝袜制服| 亚欧美综合网。| 九九九九九九九九九九九免费国产| 国产精品久久久久综合| 免费一级视频特黄色大片| 亚洲欧美日韩免费观看| 蜜桃久久一区二区| 屁股久久久久久久| 老熟女91| 精品国产一区探花在线观看| 9Ⅰ老熟女| 无码78| 久久婷婷成人综合色怡春院| 日日干日日摸| 巨乳特殊服务按摩| 一区二区视频在看| 白丝AV| 日本不卡二区| 激情婷婷综合久久| 人妻无一区二区三区| 天天插网| 午夜福利国产欧美日韩夜夜| 高潮的A片激情扒开一区| av在线播放国产一区| 超碰免费人妻人人| 先锋激情∨在线视频播放| 超碰97人人cao| 色激情综合网站| 国产精品福利资源在线尤物| PMv在线观看| 北野未奈加勒比av| 91精品成人| 青青草毛片| 欧美日日人人天天| 九九综合| 1240青青草一区二区三区视频天爱| KK色在线影院| 九九九九精品| 高潮毛片无遮挡高清免费| 岛国1区2区3区在线观看| 亚洲日韩av专区无码| 91福利网在线观看| 91九色蝌蚪在线观看| 亚洲欧美综合区自拍另类| 国产日韩精品人妻久久久久色欲网站 | 日本久久精品| 人人摸人人干| 久久精品人妻一区二区| 这里只有97精品| 99中文字幕| 97色伦97色伦国产欧美| 亚洲成人性| 欧美99热| 亚洲污污网站| 亚洲毛片基地专区| 亚洲乱码国产乱码精网站| 97人人模人人爽人人| 成人夜夜爽| 情色五月天网| 国产精品久久久久久久久久久久久久| 十八禁视频一区二区| 蜜乳AV一区| 天堂蜜桃无码视频一区二区| 国内97干免费看| 女性喷水高潮在线观看| 亚洲暴力强奸AV| 清柠毛片| 亚洲精品97久久中文字幕| 天天综合网91| 欧美日韩性爱视屏免费看了| 99精品丰满人妻无| 最新AV在线| 乱伦图av| 久久九七| 色图综合| 五月丁香综合激情| 青青草白白色| 欧美一区二区三区不卡高清视频| 新版天堂中文资源8在线| 97香焦色区| 精品女同一区| 国产成年女人免费视频播放a| 色婷婷基地| 欧美伦乱爱| 最新亚洲黄色免费电影| 99这里只有精品| 97超色| 日韩在线地址一| 色综合天天| 国产AB视频| 免费人成在线观看网站品爱网| 狠狠干综合| 青青草女人天天干| 亚洲一卡2卡3卡4卡乱码网站 | 刺激性视频黄页| 91欧美情色| 秋霞无码av鲁丝片一区| 久久久久网站-538在线视频-欧美永久乱码| 亚洲黄色| 99亚洲精品| 日本一线产区和二线产区伦理片| 日韩欧美字幕亚洲一区二区| 欧美激情色婷婷花野真衣一区二区| 久久色网| 精品网站9999| 色色色日本| 青青草原狼av| 国产精品精品系列在线观看| 久久免费中文字幕在线观看| 青娱乐淫乱1314| 116美女午夜| 免费AV中文网在线观看| 九九久久一区二区三区| 100啪啪视频大全| 91n美女视频| 亚洲网站一区二区在线| 欧美一区二区日韩传媒搭讪精品| 秋霞 色色| 欧美综合第一| 亚洲中文国际强奸字幕| 日韩黄色小说| 麻豆国产免费影片| 91丝袜美女视频| 一区二区三区精品黑丝白丝酒店对鸡 | 99热18这里只有精品| 色乱二区| 99999久久精| 亚洲综合小说另类图欧美视频激情小说色五月天| 91欧美色| 国产AV人人 夜夜人人澡| 亚洲欧洲日韩天堂av| 加勒比AV天堂| 婷婷色在线| 黑人娇小av在线播放| 啊啊啊好湿国产一二| 国产一区自拍欧美日韩| 中日韩久久久免费看| 五月丁香激情综合| 韩美日操逼| 99国产精品自在自在| 欧美在线播放aaaa| 91福利网在线观看| 好爽要喷了| 麻豆久久视频在线地址| 国产亚洲中文不卡二区| 91中文字幕制服丝袜免费视频| 特污免视频| 欧美一级久久久丰满| 久久有码视频| 玖玖综合色| 精品少妇一区二区三区在线视频| 在线视频97| 青青草无码视频| 999久久久精品国产| 18禁美女裸体无遮挡啪啪| 啊啊啊 在线| 综合 青草 伊久久 影院 综合| 无码在线亚洲| 成全动漫视频观看免费下载| 中文字幕第二页| 亚洲美欧999| 欧美 亚洲 偷拍自拍| 午夜福利激情在线视频| 欧美78P| 日韩高清一二三| 九一屌逼| 最新AVzaixian| 自慰白浆在线观看| 人人操人人摸人人看人人干| 91天天综合| 久久精品无码不卡| 人人操人人射人人干| 99热综合在线| 一区二区激情国产熟女| 无码抄逼网| 亚洲精美粉嫩嫩泬在线观看| 欧美日韩在线视频网站| 中国特猛少妇色xxx| 狠狠干妹子| 嗯嗯啊啊好疼| 男人久久精品| 久久超碰免费的| 亚洲熟妇乱女区二区三区| AAA久久| 中文字幕狠狠玩| 欧美综合娱乐久久| 国产精品一区av在线| 日韩性爱一级片| 特污精品女优骚货黄色视频在线免费观看| 无码人妻丰满熟妇区毛片| 欧美后入视频| 人人噜夜夜操| 国产第二页| 日韩精品怡红院| 免费网色网站| 亚洲天天影视色综合| 欧美中字二区| 人人爽人人精品乱人伦AV| 又摸又舔在线观看网站| 91av天美性媒精品视频| 啊啊好多水| 久久久久久91香蕉国产| 天天内射| 亚洲国产青青| 国产AV线| 久久精品超碰| 永久免费观看的毛片的网站| 国产呦精品系列在线观看| 亚洲巨爆乳一区二区三区四季网| 五月丁香黄色网| 精品国产无码中文| 手机在线播放国产福利| 岛国黄色大片网站| 亚洲人人操| 中文字幕二区日韩天堂| 久久亚洲不卡一区二区三区 | 97超碰超碰| 一区AV| 国产一进一出视频网站| 亚洲AV无码久久久国产精品| 密桃99999| 日本裸体久久色噜噜| 青青草大香蕉在线视频| 福利五区| 欧美精品三级黄片| 天天做日日做天天欢。| 婷婷五月成人| 久久99999| 亚洲色图欧美色图综合| 91视频综合| AV网站高清无码在线观看| 色婷亚洲五月在线观看| 熟女一区二区| 男人的天堂kva| 91麻豆天美| 欧美日韩精品一区二区三区高清| 五月婷婷大香蕉| 免費人妻夜夜爽天天爽爽一区| 大香蕉之青青草原| 青青草福利视频| 啪啪AV导航| 91天天日| 久久精品无码不卡| 欧美精品23| 天天肏夜夜肏| 99在线观看无大码| 亚洲图片欧美| 草莓精品视频| 中文字幕97色| 午夜毛片亚洲精品片国产久久久| 天天色,天天干,天天干| 日本韩国一本产品小视频日本韩国一本产品久久久产品小视频日本韩国一本产品久 | 色噜噜狠狠色综无码久久| 免费在线看黄片av| 色婷婷亚洲婷婷| 久久熟女久| 大象AV在线| 99久久网站| 久久久久久久久久久久久久久久9| 精品久久久久久久| 日本在线激情一区二区三区| 久久国模av| 精品人妻一区二区三区在| 天天躁日日躁AAAXX| 一区二区不卡| www久久国产精品| 91超级碰碰| 9ⅰ久久久天天| 两女互慰AV高潮喷水在线观看| 激情丁香五月| 日韩内| 色色色色电影网| 日本中文字幕一区| 性久久| 91色图片| 26UUU欧美日本| 在现视频女上位好爽| 欧美熟妇色| AV综合中文字幕干| 九九九只有精品| 天堂中文日本在线观看| 色偷综合| 人人操人人操草草| 视频黄站| 国产精品午夜高潮呻吟久久av| 久久精品中文| 92人人操人人| 最新9久久久9免费视频| 操我无码| 少妇大屁屁| 色吧综合网| 亚州欧美另类| 国产亚洲一黄| 国产精品午夜AV完会免费 | 亚洲欧美清纯| 久久亚洲影院一区二区| 神马久久久久久| 欧美一级欧美三级在线观看| 日本黄大片在线观看视频| 污到发麻的视频 国产| 亚洲欧美成人网站AAA| 区一在线观看| 三级特黄60分钟播放| 东京热精品97综合网| 亚洲AV秘 精品久久老牛影视| 加勒比人妻综合| 午夜精品久久久久久久99蜜桃一| 午夜经典| 四虎影视在线| 国产精品久久99日日| 色婷婷A V一二三四区麻豆综合| 国产精品熟女乱伦| 国产一区在线播放| baiduhicn.com。| 男人的天堂一区三区| 欧美伊人电影| 久久中文色图| 人妻少妇av在线观看| 国产精品网址| 久久久久78| 色色五月天婷婷| 婷婷av在线中文字幕| 亚洲 综合 第一页| 91N欧美| 日本成人A片免费看| 人妻激情视频| 狠狠操一区二区| 精品国产肉丝袜在线拍国语| 亚洲阿v天堂在线| 中文字幕97色| 九九热免费视频| 天天插夜夜操| 啊啊啊啊啊啊在线| 中文一区在线日| 超碰人人妻| 在线欧美69V免费观看视频| 久久岛国| 中文字幕视频免费| 日韩专区数据列表-第3230页-精品国产一区二区三区香蕉 久久99熟女人妻中文字 | 九九无码久久精品视频| 无码精品人妻一区二区三区妖精| 天天久久| 羞答答AV中文字| 国产精品久久久蜜臀| 天美传媒Av在线| 操久久久久久| 伊人女女资源在线观看| 亚洲国产另类在线中文| 男人天堂毛片| 天天日美女的B| 亚洲欧洲美腿丝袜| 9 9精品一区二区三区| 手机在线人成免费视频| 亚洲精品成人动漫在线| 日韩综合色图| 国产91 丝袜在线播放 | 中日韓欧美高清| 91激情国产| 国产美女激情| 亚洲综合113页| 男人天堂久久精品| 婷婷久久五月| 国产亚洲日本精品在线| 天天日天天搞天天干| 国产精品人妻无码久久久老鸭窝| 91操熟女视频| 人人九九精| 天天影视网色欲色香| 伊人青青草久久| 射丝袜高跟鞋99| 久久精品欧美一区蜜桃| 色哟哟的毛片| 天天弄天天操| 国产九月婷婷| 亚洲综合五月天婷婷丁香| 亚洲色欲天天人妻无码系列专区| 国产成人免费观看在线视频 | 韩国毛片一区二区三区| Aa东京男人的天堂| 91色色综合| 黄色片G G G| 中国熟女91| 99精品丰满人妻无码| 久久是精品| 97欧美色综合| 高潮9999外国| 97国产|免费| 久久久久久久9| 欧美黑人极品高潮喷吹熟女黑人性暴力日韩在线欧美极品一区二区老师黑人潮喷一 | 欧美性爱十八禁| 性爱精品一区| 婷婷午夜| 婷婷香蕉欧美在线一区二区三区| 亚洲欧美激情另类色图| 日本不卡高清免v欧美日韩在线观看| 精品精品精品| 亚洲最大的黄色电影网站。| 久久久久久久78| 天天激色| 欧美自拍网| 日韩成人无码| 国产福利在线视频网站| 一个人免费HD91视频| 开心五月天激情网| 亚洲一二三精品久久网| 九九九九九用不成了| 91久热| 天美传媒AV在线播放| 大香蕉免费3| aaaa少妇高潮大片| 午夜精品久久久久久久男人的天堂 | 亚洲s在线观看| 亚洲色图欧美另类在线| 偷拍欧美亚洲| 肏逼视频日本| 日本视频一区二区三区| 色婷婷六月| 久久色一区二区| 欧美高清91| 久综合国内精品自在自线| 日本精品高清一二区一本到| 青青草原人妻| 俺去啦自拍| 国产成久久综合片| 99久久综合网| 狠狠亚洲| 黄色大片视频在线免费看| 中文字幕交换人妻| 性色avv| 亚洲精品乱码久久久久久蜜桃麻豆 | 在线播放成人网站| 麻豆伊人网| 深夜国产福利| 在线观看亚洲专区| 日本精品88888888| 蜜区区视频79| 亚洲精品一二区| 91狠婷| 女人18精品一区二区三区| 日本一区二区亚洲综合| 日韩午夜啪啪视频| 一牛一区二区三区久久| 欧美色视| 91日本在线观看| se,,,亚洲欧美| 亚洲精品97| 色欲久久综合| 人妻天天爽| 国产一区二区在线播放量| 小泽玛利亚一二三| 亚洲AV秘无码一区..| 国产AV久久久蜜爱影集| 麻豆伊人网| 日本精品一级二级三级| 日韩精品 资源| 啊啊啊慢点| 最新日产中文在线麻豆| 人妻人人澡人人爽人人| 亚洲一区日韩精品中文字幕| 七久久久| 男人的天堂久久久| 欧美一级色| 自拍第一页| 最新中文字幕精品在线| 金典av| 天天干天天燥| 大香蕉综合久久| 成 人 A V免费视频在线观看| 欧美色图天堂在线| 好涩综合| 七久久久| 九九碰九九爱97超| 蜜桃久久综合视频| 男人天堂2030| 伊人天堂在线| 国产91影院| 按摩中文字幕| 国产黄色视频久久| 西西美女视频网| 无码国产Av| 蜜桃久久久久久久久久久久| 2019久久久久久久久福利| 日韩美女,国产传媒,视频一区| 黑人精品一区二区在线播放| AV老汉| 国产精品免费日韩| 色偷偷男人的天堂麻豆| 日本高清_区二区三区| 亚洲文学偷乱拍啪啪啪啪 | 狠狠做深爱婷婷久久二区| 欧美十八禁导航成人| 男人的天堂久久狠| 尤物一级在线免费观看| 高精欧美色| 麻豆天美电影一区二区| 国产精品第一区第一页| 欧美日韩国产电影| 国产第25页在线观看| 快播久久人人aV| 亚洲有码 欧美精品| 国产乱伦搜索结果91P| 精品一久久久| 国产AV超爽| 91性感在线| 粉嫩国产精品久久久| 国产精品一级片在线看| 四虎在线视频| 9久久9综合| 欧美顶级黄色大片免费| 亚洲影视综合| 蜜臀99999| 激情综合五月丁香| 69视频入口| 国产精品3| 久久人人妻| 懂色av色欲av蜜臀av| 欧美草草高清日韩视频| 99爱久久视频频| 亚州AV无码国产精品| 国产路线专区| 97在线无精品| 久久五月份| 做爱A级亚欧| 色五月av| 精品妇操一区二区三区| 亚洲情色五月天 | 97久久久久久久久久| 中文字幕视频在线观看一区二区| 亚洲蜜乳av| 欧成人精品H无码| 熟女高潮合集-永久久久-成人AV| 欧美躁死她一区二区| 国产乱伦亚洲| 97久久网| 欧美色97| 嗯,啊。舔我逼| 天堂资源欧美| 色九月婷婷| 国产AV激情无码久久无码| 蜜臀99久久精品久久久懂爱| 伊人96在线| 操一区| 泰国AV在线观看| 91综合在线| 色情乱伦AV| 老熟女搡BBBB搡BBBB视频| 台湾佬大香蕉| 色天天野狼综合社区| 色网综合网| 自拍丝袜美腿人妻| 久久超碰爱| 亚洲超碰在线| 中文字幕狠狠玩| 蜜乳av一区二区| 久久午夜鲁丝片| 91色综合| 久久东京热久久| 亚洲女优有码无码高清| 日本黄色天堂| 国产女人9999| 91超碰碰在线| 中文字幕97色| 久久亚洲人妻| 熟妇艹鸡八| 宅男91视频在线播放| 天美传媒国产原创中文字幕亚洲欧美另类| 亚洲中文一区二区三区视频| 欧美日韩操逼动图| 思思热久久成人| 岛国激情视频软件| 中文字幕一区二区免费在线| 欧美日韩大黄片| 久久久久久久久久久免费精品| 少妇被c 黄 免费观看| 在线亚洲欧美| 亚洲精品97| 强奸乱伦 亚洲一区| 日韩视频精品在线观看| yaouchengrenav| 国产精品高清2021在线| 亚洲日韩视频二区| 亚洲无码成人精品| 亚洲精品人妻在线| 九色在线熟女国产黑人| 99www.bibizy香蕉资源国产一区二区三区高清| 亚洲综合网电影91| 97玖玖人妻| 青青操在线亚洲视频观看欧美在线 | 91性生活久久久| 秋霞午夜视频一区二区| 97爱b| 国内一区二区三区| 男人天堂导航| 亚洲av综合色区图片亚洲| 97干综合网| 一本色道久久综合亚洲二区三区| 99色在线| 精品玖九九久| 亚洲情色综合| 99久久久无码精品国产人| 草草影院日本第一页| 日本在线视频导航| 中文字幕在线观看丝袜| 蜜桃久久久久久久| 操逼999| 国产精品97超碰| 91精品国产一区三一| 欧美国产精品久久九九| 亚洲国产91精品一区二区久久| 天天干人人干天天日97| 婷婷伊人綜合中文字幕小说| 91久精品| 97视频在线视频| 亚洲高清欧美总合| 爱妃国产亚洲视频中文字幕| 日本性爱不卡视频| 日韩啪啪啪啪啪| 97亚洲欧美日韩| 东京热91| 被窝影院午夜看片无码| 亚洲制服欧美另类内射| 黄色网址久久精品欧美喷水| 欧美78| 中国特猛少妇色xxx| 国产成人自拍视频视频| 亚洲成人免费电影| 国产60区。| 超碰97伊人| 国内毛片婷婷六月色| 中文字幕黑人大片| 风月影院男女十八禁| 91狠狠综| 国产热RE99久久6国产精品首| 国产日本熟女顶级一区二区三区视频| 欧美 亚洲 91| 毛片一区二区| 色综合色综合网| 久操在97| 成人小说另类在线| 人妻少妇色综合| 99后入| 日韩黄色片子| 精品一区二区三区蜜桃臀赵总 | 欧美亚洲首页| 国产 亚洲 丝袜 制服| 综精品久久久aaaa| 精人妻一区二区三区| 18禁网站在线播放| 亚洲精品天天影视综合网| 无码78| 在线国产探花| 亚洲欧美在线综合| 国产JDAV无码视频在线观看| 亚州色交| 99999久久精| 大地资源在线观看中文第二页| 成人五月天色网| 自拍偷拍 日韩欧美| 91国产精品在线看| 国产sv美女内射| 久久草在线综合视频| 久久久久久少妇| 欧洲综合无码| 久久超碰免费的| 色呦呦国产精品免费看| 超碰久久中文| 天天cao在线| 992这里有精品| 久久二| 丁香五月婷婷基地| 国产丝袜啪啪| 五月激情天| 欧在线一二区| 97人肏| 天天看天天日天天操| 激情四射婷婷四五月天| 中文字幕第2页| 欧美九九爱| 国产操逼网站亚洲一级黄色| 久久大香蕉手机高清视频| 欧美天天| 超碰天天久久79| 91av一区二区在线观看| 麻豆成人av| 亚乱色| 欧美特黄视频网站| 国产超碰| 啪啪啪亚欧美视频| 超碰97欧美在线| 无码高清操逼| 天天α片| 秋霞无码av鲁丝片一区| 91热色| 日本欧美成人片AAAA| 国产福利合集| 一区| 日韩午夜精品一区二区三区电影| 日韩欧美蜜桃精品久久中文字幕久久| 1024人妻熟女一区二区三区| 麻豆天天躁天天揉揉AV| 美女黄色一级A视频| 国产在线观看一区二区三区| 午夜啊啊啊| 欧美黑人精品一区二区| 美女上床网站| 天堂蜜桃无码视频一区二区| www熟女乱伦com| 亚洲男人的天堂网| 超碰在线国产| 日韩精品中文字幕人妻| 国产久久日| 欧美日韩99| 欧美性爱第一页久久| 热的中文 热的有码 热的国产| 天堂8在线新版官网| 97色亚洲| 91爱看| 婷婷五月花| 99老司机精品视频在线观看| 国产亚热在线久久| 91超碰人人| 在线视频免费播放一区| 97天天摸天天爽| 国产一区二区三区久久精品太古里| www.色操逼| 欧美片第一页| 日韩日韩日韩-国产乱码精品一区二区| 日韩天美| 96久久精品一二三区色欲| 久久久久久九九九九| 中文字幕第23区| 99啪啪| 久久婷婷五月天| WWW啪啪的com| 亚洲图片欧美色| 国产精品久久久久久久久久二区三区| 久久国产视频性吧| 一区二区三区探花在线观看| 啊啊啊好舒服视频| 美国三级日本三级久久99| 搡老女人老妇女老妇老熟女怎么读| 亚洲美女自拍偷拍视频| 我要去看2个日本美女.com曹逼| 夜夜爽夜夜摸夜夜操免费视频| 中文字幕艹艹| 大香蕉AV在线| 日韩一级成人毛片免费观看 | 色诱avtt| 精品久久視頻在线| 国精精品无码一二三区水多多| 欧美不卡五十路| 欧美激情 亚洲色图| 免费亚洲国产精品久久一区| 和协无码影院| 日韩精品一二三四| 色综合色欲色综合色综合色综合| 翔田千里AⅤHD无码| 欧美组图日韩亚洲中文字幕| 亚洲性刺激| 91网站在线播放| 狠狠色一区二区中文字幕| 红桃视频高潮| 欧美黑人猛交春色影视大全| 依人大香蕉| 97精品综合久久| 久久国内| 国产一级作爱毛片| 日本狂喷奶水在线播放212| 一区二区三区免费视频入口 | 欧美永久激情一区二区| 涩涩久久精品| 性色亚洲| 天天拍夜夜| 丝袜综合网| 91色欧美| 久久精品一区一起草| 色爽——AV| 欧美91久久久久| av东京热男人的天堂| 日韩精品电影| 狠狠躁日日躁夜夜躁A| 国产白丝在线| 91爱做| 精品久久大胆人体| 亚洲日韩熟女人妻高清在线| 日韩人妻无码精品系列| 日日A∨| 国产欧美黑人丰满在线| 精品人妻一二三四区视频| 黄色片G G G| 日本精品一区二区三| 91色射| 欧美日韩狠狠爱| 中文乱码字幕观看视频| 在线视频97| 妇女性内射冈站HDWWWCOM| 一级@啪啪视频|