生成式AI邊緣運算平台建置和大型語言模型壓縮技術開發計畫
技術介紹:
1. 跨平台模擬與硬體抽象化(Hardware Abstraction + Performance Modeling)透過建立不同 Edge AI 晶片(如 NPU / GPU / DSP)的效能模型與資源限制(memory bandwidth、compute throughput、latency),在無實體板卡的情況下,模擬 AI model 在指定硬體上的實際運行表現。支援多種設定條件(input resolution、batch size、quantization level),可快速預測 FPS、latency、功耗與記憶體占用。
2. 模型與系統層整合模擬(Model + Pipeline Co-simulation)
不只針對單一模型,而是涵蓋完整 AI pipeline(pre-processing、inference、post-processing)。可模擬實際應用場景(如 ADAS、DMS、Smart Surveillance),評估 end-to-end latency、multi-model scheduling、task contention 等問題,提前發現 bottleneck(例如 I/O blocking 或 NPU utilization 不均)。
3. 自動化部署與配置生成(Auto Deployment & Toolchain Integration)
模擬完成後,自動輸出對應目標平台的部署配置(包含 model conversion、quantization、runtime settings),並透過一鍵佈建機制(CI/CD-like flow)將模型與系統直接部署到指定 Edge AI device。支援主流 toolchain(如 TensorRT、TFLite、ONNX Runtime、vendor SDK),降低 porting 與 tuning 成本。
產業應用性:
eAI-SIM 為開發者提供一個可自訂的 AI 開發與測試環境,支援在多種運行平台設定下進行模型與系統行為的精準模擬與驗證。開發者可以依照目標邊緣 AI 晶片、作業系統、資源配置(運算能力、記憶體、頻寬)以及預期應用場景條件,建立對應的虛擬執行環境,並在其中直接檢驗 AI 模型效能與系統整體負載表現。透過此環境,開發者能在不依賴實體開發板或完整韌體的情況下,先完成模型調校與系統配置規劃,為後續正式佈署到實際裝置打好基礎。同時,在完成驗證後,開發者可透過平台的一鍵操作,將模型與相關系統設定同步自動佈署至指定晶片,無縫銜接實機運行與落地流程。
峻魁智慧股份有限公司
峻魁智慧科技股份有限公司 (eNeural Technologies, Inc.)成立於 2022 年,總部位於新竹科學園區,為專注於嵌入式人工智慧(Embedded AI)與邊緣運算(Edge AI)的人工智慧設計服務公司。公司源自陽明交通大學智慧視覺系統設計實驗室,團隊在視覺 AI 與 先進駕駛輔助系統(Advanced Driver Assistance Systems, ADAS)領域深耕超過十年,擁有從演算法、模型訓練到晶片實作的完整技術能量。公司已自主創新研發的eAI Craft 與eSL-Craft軟體工具鏈為核心,提供輕量化 AI 模型(Lightweight AI Models)、高效率訓練與推論技術,協助客戶在不同硬體平台上快速導入高精度且低功耗的Edge AI 模型功能。公司服務範圍涵蓋 ADAS、移動機器人、AIoT 裝置等,並提供從資料標註、模型設計、模型壓縮(Model Compression)、模型量化(Model Quantization)到超低功耗神經網絡處理單元矽智財(Ultra-Low Power Neural Processing Unit (NPU) IP,以下簡稱 ULP NPU IP)授權的整合方案。