
邊緣端 AI 算力選型建議你從場景倒推芯片把“邊緣端 AI 算力選型”這件事拆開講之前先說一個(gè)我在評審項(xiàng)目方案時(shí)遇到的高頻問題很多人拿到任務(wù)第一反應(yīng)是去翻芯片參數(shù)表哪顆算力高、哪顆賣得火就選哪顆結(jié)果設(shè)備拿到現(xiàn)場要么模型跑不動(dòng)要么功耗壓不住要么環(huán)境溫度一高直接降頻罷工。邊緣端 AI 算力選型的正確姿勢恰恰不是“從芯片出發(fā)找場景”而是先把業(yè)務(wù)場景解剖清楚把需求翻譯成算力語言再倒推芯片型號。下面我會(huì)結(jié)合自己做過的項(xiàng)目經(jīng)驗(yàn)從場景拆解、算力指標(biāo)、芯片對照、實(shí)操驗(yàn)證、問題排查五個(gè)方面把這條路徑完整走一遍。1. 場景反推芯片為什么這是邊緣端選型的第一原則1.1 一次失敗的選型復(fù)盤先定芯片再找場景先講個(gè)真實(shí)教訓(xùn)。之前有個(gè)設(shè)備點(diǎn)檢項(xiàng)目技術(shù)負(fù)責(zé)人特別篤定地說主控就用 RK3588理由是算力強(qiáng)、社區(qū)資料多、以后擴(kuò)展方便。但我們?nèi)ガF(xiàn)場看了一圈發(fā)現(xiàn)設(shè)備是個(gè)需要電池供電的巡檢儀裝在戶外立桿上夏天表面溫度能到 50 度以上整機(jī)功耗預(yù)算只有 5W 左右。RK3588 在這個(gè)約束下根本施展不開光是散熱設(shè)計(jì)就夠喝一壺。最后方案推翻重做換成了一顆低功耗 SoC算力雖然小了一個(gè)量級但整機(jī)功耗、成本、可靠性全部達(dá)標(biāo)。復(fù)盤時(shí)我意識(shí)到選型失敗往往不是算力不夠而是約束條件從最開始就沒被認(rèn)真對待。邊緣端項(xiàng)目跟云端項(xiàng)目最大的區(qū)別在于它有一堆“物理約束”卡著你供電、散熱、尺寸、環(huán)境溫度、網(wǎng)絡(luò)帶寬、維護(hù)周期。不考慮這些單純比 TOPS 就是在紙面上打靶。1.2 拆解場景五要素把業(yè)務(wù)翻譯成算力語言我現(xiàn)在做選型之前一定會(huì)先逼著需求方回答五個(gè)問題這五個(gè)問題基本能把場景畫出一個(gè)清晰的輪廓第一是數(shù)據(jù)模態(tài)。你要處理的是單路圖像、多路視頻、音頻信號還是傳感器時(shí)序數(shù)據(jù)如果只是溫濕度、振動(dòng)這類傳感器數(shù)據(jù)用一顆 MCU 就夠了如果是 1080p 30 幀的視頻流那 CPU 基本扛不住必須有專用的 NPU 或者硬件編解碼模塊參與。第二是時(shí)延訴求。門禁人臉識(shí)別要求毫秒級響應(yīng)用戶刷臉之后不能盯著屏幕等兩秒AGV 避障要求實(shí)時(shí)性延遲大了就是安全事故但園區(qū)夜間巡檢要做的事后分析可以接受秒級延遲。這個(gè)維度直接決定你能不能上大模型或者只能跑輕量模型。第三是供電與功耗。電池供電和市電供電是兩個(gè)世界。電池設(shè)備通常整機(jī)功耗要壓到 3W 到 10W 以內(nèi)市電設(shè)備則可以放開到 15W 到 30W 甚至更高。功耗反過來又決定散熱方案被動(dòng)散熱還是主動(dòng)風(fēng)扇這又影響設(shè)備的體積和可靠性。第四是模型規(guī)模與算子結(jié)構(gòu)。同樣是目標(biāo)檢測YOLOv5s 和 YOLOv8m 的計(jì)算量差好幾倍同樣是語言模型0.5B 參數(shù)和 7B 參數(shù)對內(nèi)存帶寬的要求完全不在一個(gè)量級。你的模型里是什么算子決定了芯片 NPU 能不能高效承接。比如 Transformer 結(jié)構(gòu)里的 LayerNorm、GELU 這類算子很多邊緣 NPU 支持得并不好需要特殊處理。第五是成本與供應(yīng)鏈。批量 100 臺(tái)和批量 5000 臺(tái)的芯片成本敏感度完全不同。國產(chǎn)化要求、供貨周期、開發(fā)工具鏈成熟度這些都會(huì)影響最終選型。很多項(xiàng)目死在冷門芯片上就是因?yàn)槲臋n太少、踩坑沒人分享開發(fā)周期被拉長到不可接受。把五個(gè)問題答案寫下來選型范圍基本就能縮小到兩三顆芯片。1.3 邊緣端選型的三個(gè)經(jīng)典誤區(qū)誤區(qū)一TOPS 越大越好。TOPS 只是理論峰值實(shí)際吞吐受算子支持、內(nèi)存帶寬和軟件生態(tài)影響很大。我測試過一顆標(biāo)稱 6TOPS 的芯片跑 YOLOv5s INT8 只有 30fps另一顆標(biāo)稱 3TOPS 的專用芯片同模型能到 45fps。差距就是 NPU 對算子支持的差異。所以標(biāo)稱性能只能做初篩最終決策必須看實(shí)測數(shù)據(jù)。誤區(qū)二只關(guān)注推理時(shí)間忽略前后處理開銷。AI 推理只是鏈路中的一環(huán)。圖像采集、預(yù)處理、縮放、格式轉(zhuǎn)換、編解碼、后處理 NMS這些都要吃 CPU 和內(nèi)存帶寬。很多芯片 NPU 跑得快但 CPU 太弱整鏈路延遲被拉得很高。選型時(shí)一定要看“整鏈路性能”不是只看模型推理耗時(shí)。誤區(qū)三沒有評估模型部署的隱性成本。不同芯片對應(yīng)不同的推理框架NCNN、ONNXRuntime、RKNN、TensorRT 各有各的適配范圍。如果模型里有芯片不支持的算子要么改寫網(wǎng)絡(luò)結(jié)構(gòu)要么讓算子落到 CPU 上跑這些都是隱性開發(fā)成本。選型時(shí)不能只算芯片單價(jià)要把工具鏈學(xué)習(xí)成本、算子適配成本都算進(jìn)去。2. 看懂算力參數(shù)TOPS 背后的決定性細(xì)節(jié)2.1 同一個(gè) TOPS不同精度格式的實(shí)際算力差距TOPS 是 Tera Operations Per Second 的縮寫每秒萬億次運(yùn)算。但同樣標(biāo) 1TOPSFP32、FP16、INT8、INT4 對應(yīng)的真實(shí)處理能力差很多。芯片廠商標(biāo)稱算力時(shí)有的標(biāo) FP16有的標(biāo) INT8有的會(huì)取一個(gè)最大理論值不仔細(xì)看備注就會(huì)被誤導(dǎo)。以我常用的經(jīng)驗(yàn)換算來看同一顆芯片在不同精度下的算力比例大約是 FP32 比 FP16 比 INT8 比 INT4 接近 1 比 2 比 4 比 8。也就是說一顆標(biāo)稱 4TOPS INT8 的芯片如果能跑 FP16有效算力大約是 2TOPS跑 FP32 就只有 1TOPS 左右。邊緣端部署模型基本都走 INT8 或更低的 INT4 量化所以選型時(shí)優(yōu)先看芯片的 INT8 算力同時(shí)確認(rèn)廠商的量化工具鏈?zhǔn)欠癯墒?。工具鏈不成熟INT8 算力再高也是紙上談兵。2.2 內(nèi)存帶寬是隱形的性能瓶頸算力高但內(nèi)存帶寬低性能會(huì)被死死卡住。打個(gè)比方算力是工廠的生產(chǎn)線速度內(nèi)存帶寬是原材料運(yùn)送能力運(yùn)不過來生產(chǎn)線只能空轉(zhuǎn)。這個(gè)問題在大模型場景尤其致命。一個(gè) 7B 參數(shù)模型半精度參數(shù)就有 14GB 左右如果芯片內(nèi)存帶寬只有幾十 GB/s光搬運(yùn)參數(shù)就要幾百毫秒推理延遲根本壓不下去。所以我做邊緣端大模型選型時(shí)除了看 TOPS會(huì)重點(diǎn)算一筆賬模型參數(shù)總量乘以每 token 計(jì)算量再除以可接受延遲看芯片內(nèi)存帶寬夠不夠用。很多高算力芯片最后跑大模型效果不佳瓶頸就在帶寬上。2.3 功耗和散熱容易被忽略的硬約束邊緣設(shè)備經(jīng)常待在高溫車間、戶外桿子、車輛中控臺(tái)這種地方?jīng)]有恒溫機(jī)房。芯片標(biāo)稱功耗和實(shí)際推理負(fù)載下的功耗有差距推理起來電流沖擊和溫度爬升可能比預(yù)想嚴(yán)重。選型時(shí)要給整機(jī)功耗留出 20% 到 30% 的余量因?yàn)檎麢C(jī)還要疊加內(nèi)存、傳感器、顯示屏、網(wǎng)絡(luò)模塊這些外圍功耗。散熱方面如果產(chǎn)品用密封外殼加被動(dòng)散熱散熱能力一般只有 5W 到 10W 級別芯片功耗太大會(huì)自動(dòng)降頻性能打折。有些項(xiàng)目為了壓功耗被迫犧牲模型精度那就違背了選高算力芯片的初衷。這里面的權(quán)衡必須在選型階段就想清楚。2.4 主流邊緣 AI 芯片算力速查表下面這張表是我整理的主流邊緣 AI 芯片對照標(biāo)稱數(shù)據(jù)源于各家公開資料實(shí)際性能建議以實(shí)測為準(zhǔn)芯片型號NPU算力INT8口徑典型整機(jī)功耗適合場景ESP32-S3極低0.1TOPS0.3W 左右語音喚醒、傳感器分類STM32N6約 1TOPS0.5W 左右極輕量視覺、關(guān)鍵詞識(shí)別RV1106約 0.5TOPS1W 到 2W單路攝像頭、小模型檢測RK3566約 0.8TOPS3W 到 5W輕量視覺盒子、雙路視頻地平線X3派約 5TOPS5W 到 7W單/雙路攝像頭、輕量識(shí)別RK3576約 6TOPS5W 到 8W多路視頻、中端AI盒子RK3588約 6TOPS8W 到 15W四路以上視頻、多模型并行Jetson Orin Nano約 20 到 40TOPS7W 到 15W復(fù)雜模型、機(jī)器人、大模型Jetson Orin NX約 100TOPSFP16口徑15W 到 25W端側(cè)大模型、多模態(tài)處理表格里有一些芯片標(biāo)稱口徑不同比如 Jetson Orin NX 常用 FP16 算力標(biāo)注和瑞芯微的 INT8 口徑不能直接比。比較時(shí)需要先統(tǒng)一精度口徑我通常把各家數(shù)據(jù)都折算成 INT8 等效再對比才不會(huì)被紙面數(shù)字誤導(dǎo)。3. 場景、芯片映射四檔典型配置推薦3.1 MCU 級極輕場景語音喚醒、傳感器分類、極簡單分類先說最容易的一檔。智能門鎖里的關(guān)鍵詞喚醒、工業(yè)設(shè)備振動(dòng)信號異常判別、環(huán)境聲音分類這類場景模型通常只有幾十 KB 到幾 MB對算力要求極低但對功耗、啟動(dòng)速度、成本非常敏感。用 STM32N6、ESP32-S3 這類芯片就夠了幾百毫瓦功耗毫秒級啟動(dòng)成本控制在幾十元以內(nèi)可以長時(shí)間電池供電。這類芯片跑 AI 不能用傳統(tǒng)的方式PyTorch 訓(xùn)練好的模型要先轉(zhuǎn)成 TFLite 格式再用 TFLite Micro 或者 CMSIS-NN 這類庫部署到 MCU 上。我遇到過不少嵌入式工程師第一次搞這個(gè)發(fā)現(xiàn)模型轉(zhuǎn)換后算子不支持只能回頭改網(wǎng)絡(luò)結(jié)構(gòu)。所以 MCU 級選型除了看算力還要看推理框架的算子兼容列表。3.2 單、雙路視頻輕量識(shí)別門禁、車牌、安全帽檢測小區(qū)門禁、出入口車牌識(shí)別、工地安全帽檢測這類場景輸入一般是單路或雙路 1080p 的 RTSP 視頻流模型以 YOLOv5s、YOLOv8s 這類輕量目標(biāo)檢測網(wǎng)絡(luò)為主要求 15fps 到 25fps 的實(shí)時(shí)處理。這個(gè)檔位我用得最多的是瑞芯微 RV1106、RK3566或者地平線旭日 X3 派。以 RV1106 為例價(jià)格便宜集成 ISP 能直接接攝像頭整機(jī)功耗能壓到 2W 左右非常適合做戶外抱桿設(shè)備或者弱電箱里的 AI 小盒子。RK3566 算力和內(nèi)存更大一些適合同時(shí)跑檢測加分類兩個(gè)模型。這批芯片的NPU雖然不大但勝在能效比高而且瑞芯微的 RKNN 工具鏈已經(jīng)很成熟網(wǎng)上案例多遇到問題基本能搜到解決方案。做這類項(xiàng)目還有個(gè)關(guān)鍵點(diǎn)視頻解碼不能走 CPU 軟解要直接用芯片的硬件解碼模塊。軟解 1080p 30 幀就會(huì)占滿 CPU留給 AI 的資源就少了。選型時(shí)要確認(rèn)芯片有硬件視頻解碼能力并且 SDK 里提供了對應(yīng)的調(diào)用接口。3.3 多路視頻流與端側(cè)大模型RK3588、Jetson Orin 系列工廠質(zhì)檢、倉庫安防、無人巡檢機(jī)器人這類場景往往要同時(shí)跑多個(gè)模型比如目標(biāo)檢測、缺陷分類、OCR 識(shí)別并行或者需要直接部署量化后的大語言模型做本地知識(shí)問答。這個(gè)檔位我主力推 RK3588 和 Jetson Orin 系列。RK3588 是當(dāng)前國產(chǎn)邊緣 AI 盒子的出貨主力8 核 CPU 加 6TOPS NPU可以同時(shí)硬解四路以上 1080p 視頻流跑兩三個(gè)檢測模型加一個(gè) OCR 模型也不吃力。配合雙千兆網(wǎng)口和豐富的外設(shè)接口非常適合做邊緣計(jì)算網(wǎng)關(guān)。價(jià)格在千元級對比同類產(chǎn)品性價(jià)比不錯(cuò)。如果你的項(xiàng)目規(guī)模中等對成本敏感RK3588 是第一優(yōu)先級。Jetson Orin Nano 的優(yōu)勢是英偉達(dá)生態(tài)。TensorRT 的優(yōu)化很到位CUDA 環(huán)境對開發(fā)者友好適合跑結(jié)構(gòu)復(fù)雜、需要大量算子定制的模型也適合和 ROS 系統(tǒng)結(jié)合的機(jī)器人項(xiàng)目。缺點(diǎn)是價(jià)格高開發(fā)板級別就要兩千以上供貨也有波動(dòng)批量產(chǎn)品要考慮長期供貨風(fēng)險(xiǎn)。如果想在端側(cè)跑 2B 到 7B 參數(shù)的大語言模型當(dāng)前性價(jià)比路線是 Jetson Orin NX 級別或者選國產(chǎn)帶 16GB 到 32GB 大內(nèi)存的高算力核心板。這里要特別強(qiáng)調(diào)內(nèi)存容量和帶寬大模型對內(nèi)存帶寬的要求遠(yuǎn)高于對 TOPS 的要求選型參數(shù)上要把帶寬放在第一優(yōu)先級。3.4 專用加速卡與異構(gòu)組合算法固定、超高吞吐場景有一種場景比較特殊算法已經(jīng)固定比如某條生產(chǎn)線上只檢測一種瓶蓋的瑕疵24 小時(shí)不間斷運(yùn)行要求極高吞吐和極低誤報(bào)。這種情況可以考慮 FPGA 或者專用 ASIC 加速卡。FPGA 比如 Xilinx Kria 系列可以在 5W 到 10W 功耗下實(shí)現(xiàn)比較強(qiáng)的并發(fā)處理而且延遲確定性好適合對穩(wěn)定性要求極高的工業(yè)場景。缺點(diǎn)是開發(fā)周期長需要硬件工程師做 Verilog 或 HLS 開發(fā)只有算法凝固不變、批量足夠大時(shí)才劃算。異構(gòu)組合則是我在復(fù)雜項(xiàng)目里常用的思路前端用一顆低功耗 SoC 做圖像采集和粗過濾比如先做運(yùn)動(dòng)檢測、區(qū)域裁剪把有效數(shù)據(jù)交給后級強(qiáng)算力設(shè)備做精細(xì)分析。這樣兩個(gè)盒子各司其職前端功耗低、可分布式部署后端算力集中、可擴(kuò)展。方案對算法分層有要求如果項(xiàng)目周期緊不建議一上來就搞異構(gòu)先把單板方案調(diào)通更穩(wěn)妥。4. 實(shí)操記錄完成一次從場景到芯片的選型驗(yàn)證4.1 用需求表固定選型邊界每次選型我都先做一張需求表把場景約束寫死。舉個(gè)例子我之前做智慧課堂行為分析項(xiàng)目需求表長這樣數(shù)據(jù)模態(tài)單路 200 萬像素?cái)z像頭1080p 30 幀時(shí)延從采集到畫面疊加結(jié)果不超過 800ms功耗整機(jī)不大于 10W室內(nèi)環(huán)境帶風(fēng)扇模型YOLOv8n 加一個(gè)人臉檢測小模型預(yù)期吞吐15fps 以上成本批量 200 套單板成本 1500 以內(nèi)有了這張表選型就不是憑感覺而是有邊界條件可以對照。后面的所有驗(yàn)證動(dòng)作都圍繞這張表展開。4.2 模型轉(zhuǎn)換與量化校準(zhǔn)初步圈定候選芯片后不要急著買開發(fā)板先把模型轉(zhuǎn)換這塊跑通。以瑞芯微 RK3588 為例流程是先把 PyTorch 模型導(dǎo)出為 ONNX再用 RKNN-Toolkit 轉(zhuǎn)換成 RKNN 格式。轉(zhuǎn)的過程中最容易遇到兩類問題一是動(dòng)態(tài)輸入尺寸不支持需要把模型輸入固定到某個(gè)尺寸二是某些自定義算子在轉(zhuǎn)換時(shí)報(bào)錯(cuò)需要替換成等效的常見算子。轉(zhuǎn)換之后做 INT8 量化校準(zhǔn)。校準(zhǔn)集要選幾百到幾千張有代表性的圖片不能只選理想環(huán)境下拍的好圖要貼近現(xiàn)場光照、角度、噪聲。有次做倉庫貨物識(shí)別我用公開數(shù)據(jù)集做了校準(zhǔn)現(xiàn)場測試漏檢率飆到 30% 以上。后來換成現(xiàn)場實(shí)拍圖做校準(zhǔn)漏檢率才降到 5% 以內(nèi)。量化帶來的精度損失一般在 AP 值下降 0.5 到 2 個(gè)點(diǎn)如果降得多考慮混合精度或者把敏感層留在 FP16。4.3 benchmark 實(shí)測并記錄數(shù)據(jù)模型轉(zhuǎn)換完成后上板跑 benchmark。我的記錄模板包含下面幾項(xiàng)單幀推理耗時(shí)、預(yù)處理耗時(shí)、后處理耗時(shí)、NPU 占用率、CPU 占用率、內(nèi)存峰值、整機(jī)功耗、芯片溫度。記錄工具方面瑞芯微的 RKNN 工具自帶性能分析器英偉達(dá)平臺(tái)可以用 tegrastats 或者 trtexec 拿到詳細(xì)數(shù)據(jù)。實(shí)測中要注意多跑幾輪取穩(wěn)定值不要只看單次最佳數(shù)據(jù)。芯片剛開機(jī)溫度低時(shí)性能好跑了十分鐘溫度上來了可能就降頻所以至少要跑 20 分鐘記錄一個(gè)持續(xù)負(fù)載下的表現(xiàn)。4.4 現(xiàn)場環(huán)境驗(yàn)證與最終決策實(shí)驗(yàn)室數(shù)據(jù)只能代表理想條件最終決策前一定要到現(xiàn)場做環(huán)境驗(yàn)證。之前一個(gè)戶外車牌識(shí)別項(xiàng)目RK3566 開發(fā)板在室內(nèi)跑得很穩(wěn)拿到路口實(shí)測白天陽光直射下畫面過曝晚上車燈眩光導(dǎo)致大量誤檢。最后通過 ISP 參數(shù)調(diào)整和算法側(cè)加曝光補(bǔ)償才解決。這類問題在實(shí)驗(yàn)室根本復(fù)現(xiàn)不出來。所以我的選型流程最后一步一定是把候選方案的整機(jī)原型拿到現(xiàn)場跑滿三天收集溫度、功耗、識(shí)別率、故障率數(shù)據(jù)再回到需求表逐項(xiàng)核對。全部達(dá)標(biāo)才敢真正鎖定芯片型號。5. 常見問題排查與避坑速查5.1 幀率遠(yuǎn)低于標(biāo)稱 TOPS 預(yù)期這類問題我遇到過太多次了。原因通常是三選一算子不支持導(dǎo)致 CPU 回退內(nèi)存帶寬不足導(dǎo)致數(shù)據(jù)搬運(yùn)阻塞預(yù)處理環(huán)節(jié)搶占 CPU。排查方法是打開芯片的 Profiler 工具看每個(gè)算子實(shí)際落在 NPU 還是 CPU。如果發(fā)現(xiàn)回退算子就去換等效算子或調(diào)整網(wǎng)絡(luò)結(jié)構(gòu)。有一次項(xiàng)目因?yàn)槟P屠?GELU 激活函數(shù)在 NPU 上沒有高效實(shí)現(xiàn)我把它換成了近似 SiLU 形式推理速度直接提升接近一倍。5.2 模型轉(zhuǎn)換失敗與算子不兼容模型轉(zhuǎn)換失敗在邊緣端部署里非常常見。處理思路分三步先把后處理全部從模型里拿出來放到 CPU 實(shí)現(xiàn)然后把輸入尺寸固定下來不要用動(dòng)態(tài)尺寸最后逐個(gè)檢查自定義算子能替換就替換。我還會(huì)格外注意工具鏈版本兼容性RKNN-Toolkit 和 ONNX 版本經(jīng)常匹配不上轉(zhuǎn)換報(bào)錯(cuò)信息又不友好會(huì)浪費(fèi)很多時(shí)間。5.3 高溫降頻導(dǎo)致性能波動(dòng)設(shè)備運(yùn)行半小時(shí)后幀率掉一半大概率是溫度觸發(fā)降頻了。被動(dòng)散熱極限有限如果是密封外殼一定要留氣流通道或開孔如果環(huán)境灰塵大不能開孔就要從芯片選型上降一檔選 TDP 更低的方案或者接受性能打折而提前設(shè)計(jì)模型余量。車載、戶外場景還應(yīng)該優(yōu)先選工業(yè)級溫度范圍的芯片并且做軟性策略溫度過高時(shí)主動(dòng)丟幀、降低檢測頻率保證基本功能不中斷。5.4 量化后精度掉太多精度下降的排查有固定套路。第一查校準(zhǔn)集換貼近落地場景的數(shù)據(jù)第二逐層分析精度敏感度把敏感層保留高精度第三看是否支持 per-channel 量化這個(gè)一般比 per-tensor 精度損失小。大部分情況前兩步就能解決。5.5 多路視頻流的瓶頸不在推理同時(shí)處理多路視頻時(shí)瓶頸經(jīng)常是解碼器和內(nèi)存帶寬。以 RK3588 為例多路硬解開啟后內(nèi)存占用大漲NPU 反而空閑。優(yōu)化手段是確認(rèn)使用硬件解碼而不是軟解對不影響識(shí)別的畫面先做抽幀或降采樣再喂給 NPU。還有項(xiàng)目的碼率設(shè)置過高我在現(xiàn)場把攝像頭碼率從 8Mbps 壓到 4Mbps識(shí)別效果幾乎不變系統(tǒng)負(fù)載卻降了不少。選型這個(gè)事說到底就是給真實(shí)場景做約束下求解。別被花哨的參數(shù)表帶跑把現(xiàn)場條件摸清楚把實(shí)測數(shù)據(jù)跑出來芯片自己就會(huì)浮出水面。我個(gè)人的習(xí)慣是每次項(xiàng)目都保留完整的 benchmark 記錄和現(xiàn)場照片歸檔這些數(shù)據(jù)在下一次選型時(shí)復(fù)用價(jià)值極高。邊緣端 AI 算力沒有銀彈但只要你愿意花時(shí)間把場景解剖到位做出正確選擇的概率會(huì)大很多。