利用內部部署 LLM 邊緣伺服器加速即時生產疑難排解

隨著製造商持續採用工業 4.0 技術,許多廠商將更多資料處理移至更靠近工廠現場的位置,同時將敏感的操作資訊保留在現場。某個製造環境需要一種方法來協助操作員透過簡單的本地介面,檢閱 PLC 警報、檢測攝影機結果和維護記錄,讓技術人員可以快速檢查機器狀況和維護歷史記錄,而無需依賴雲端連線。為了滿足這項要求,Premio 部署了用於現場 LLM 工作負載的 1U 邊緣 AI 伺服器 LLM-1U-RPL,以提供本地化處理,協助團隊更快找出生產問題,並在不同班次之間維持更一致的故障排除。 

 

挑戰

  • 需要在本機執行 LLM 推論,以便操作員可以檢閱操作資料和工程文件,而無需將敏感資訊傳送到雲端
  • 現有工廠現場系統並非為支援用於即時分析的 GPU 加速工作負載而設計
  • 難以將多個工廠系統的操作資料整合到單一故障排除介面中
  • 控制櫃內部機架空間有限,需要小巧、短深度的機架式解決方案
  • 持續生產環境需要能夠安全可靠地 24 小時運作的硬體 

解決方案 

  • Premio 的現場 LLM 工作負載專用 1U 邊緣 AI 伺服器 (LLM-1U-RPL
  • PCIe Gen 4 擴充,支援整合 NVIDIA RTX PRO 4500 Blackwell GPU 以加速 LLM 處理
  • 多個 2.5GbE LAN 連接埠,配備 USB 和 COM 介面,支援與現有工廠系統整合
  • 適用於控制室和工廠基礎設施的精巧機架式外型規格
  • 冗餘 600W 電源供應器,搭配熱插拔風扇和 TPM 2.0,支援安全 24/7 運作 

效益 

  • 具備 Intel 嵌入式處理器,支援十年生命週期
  • 4 到 5 週內快速部署
  • 符合 NDAA 和 TAA 的解決方案,並由 Premio 位於洛杉磯的支援團隊提供支援 

 

公司概覽 

該公司營運自動化生產線,檢測系統持續檢查產品品質並協助操作員快速發現問題。隨著工廠中機器資料和技術文件越來越多,操作員需要一種更快的方式來檢閱這些資訊,同時在生產班次期間處理問題。作為工業 4.0 計畫的一部分,該公司引入了本地化的邊緣運算,以便更容易存取故障排除資訊,同時將敏感的生產資料保留在現場。 

 

挑戰 

需要本機 LLM 推論 

在生產班次期間,操作員在診斷設備問題時經常需要檢查機器資料和工程文件。透過雲端連線系統存取這些資訊可能會減慢回應時間,並引起對將敏感操作資料保留在現場之外的擔憂。為了解決這個問題,團隊正在尋找一種在本機執行 LLM 推論的方法,以便直接在工廠環境中提供故障排除指南。 

GPU 加速工作負載的基礎設施有限 

大多數現有工廠現場系統設計用於控制和監控,而不是執行 AI 工作負載。嘗試在相同基礎設施上處理 LLM 任務會降低系統回應速度,並限制其支援即時分析的能力。因此,團隊需要一個專用平台,可以處理 GPU 加速處理,而不會影響正常運作。 

難以跨系統存取操作資料 

機器資訊、檢測結果和維護記錄分散在多個工廠系統中。當問題發生時,操作員通常需要檢查多個來源才能找出根本原因。這使得故障排除速度變慢,並導致團隊之間以及不同班次之間的回應不一致。 

控制櫃內部空間限制 

控制室和設備櫃內的機架空間已經有限,難以在生產系統附近安裝標準深度伺服器。因此,擴展基礎設施以容納更大的硬體會增加部署的複雜性並擾亂現有佈局。團隊需要一個緊湊的機架式平台,能夠適應可用空間並更容易地整合到目前的設置中。 

安全可靠的持續運行要求 

生產系統持續運行,因此任何新硬體都必須穩定運行,不得中斷日常操作。邊緣平台還需要處理長時間運行的工作負載,同時保護敏感的工廠數據安全。為此,團隊尋找專為支援工業環境中穩定的 24/7 操作而設計的解決方案。 

 

解決方案 


Premio 的短深度 1U 邊緣 AI 機架式伺服器 (LLM-1U-RPL) 

在審查了在工廠內部直接運行 LLM 工作負載的需求後,團隊選擇了 Premio 適用於內部部署 LLM 工作負載的 1U 邊緣 AI 伺服器 (LLM-1U-RPL) 作為部署的基礎。其短深度 1U 設計使其更易於安裝在現有控制室機架中,而第 13 代 Intel Core 處理器和高達 64GB DDR4 記憶體的支援則提供了處理本地推理任務所需的性能。憑藉對 GPU 加速、PCIe 擴展以及內建可靠性和安全功能的額外支援,LLM-1U-RPL 自然融入生產環境,無需更改現有基礎設施。 

GPU 加速 LLM 處理 

在工廠內部運行 LLM 工作負載需要比現有控制系統提供更多處理能力。通過 PCIe Gen 4 擴展,Premio 的 LLM-1U-RPL 支援整合工作站級 GPU,最高可達 NVIDIA RTX PRO 4500 Blackwell,使團隊能夠在需求增加時加速本地推理。這使得在現場審查操作數據和工程文檔變得更容易,而無需依賴外部計算資源。 

與工廠系統的彈性連接 

部署還需要可靠地訪問已收集機器資訊和檢測數據的現有工廠系統。多個 2.5GbE LAN 埠,以及 USB 和 COM 介面,使得解決方案能夠與這些工廠網路整合,而無需額外的介面硬體。因此,伺服器可以在不改變工廠網路設置的情況下導入現有環境。 

緊湊的機架式部署 

由於控制室和基礎設施櫃內部的安裝空間有限,硬體尺寸是部署規劃中的重要考慮因素。憑藉短深度 1U 機架式設計,尺寸為 483 (寬) × 480 (深) × 44 (高) 毫米,LLM-1U-RPL 輕易地適應現有機架,無需改變周圍設置。其緊湊的佔用空間還允許其更靠近生產網路,以便於獲取操作數據。 

可靠且安全的持續運作 

由於生產系統持續運行,因此部署需要能夠 不間斷可靠運作的硬體。冗餘的 600W 電源供應器允許在不關閉系統的情況下進行維護或更換,而熱插拔風扇有助於在長時間工作負載期間 維持穩定效能。為了進一步支援在共享工廠環境中的操作,可鎖定的前面板、機箱入侵偵測和 TPM 2.0 為邊緣的敏感操作資料提供了 額外保護。 

 

優點 

支援處理器產品的長生命週期 

LLM-1U-RPL 中使用的第 13 代 Intel Core 處理器 Intel嵌入式產品路線圖的一部分,其生命週期長達十年,有助於確保長期可用性以進行維護規劃和未來升級。 

為時間敏感的生產環境提供更快的部署 

與通常涉及更長採購時間的大型伺服器供應商不同,LLM-1U-RPL 支援在 大約 4 至 5 週內完成部署,讓團隊能夠快速引進本地化的 LLM 推理,而無需延遲生產支援改進。 

具備本地支援的合規性 

NDAA 和 TAA 合規性 支援在具有更嚴格採購要求的環境中部署。Premio 的產品在台灣製造,在美國組裝,有助於滿足受管制專案的供應鏈預期。洛杉磯的支援團隊還在部署期間提供了 本地聯絡方式以進行整合和持續 協助 

 

結論 

在工廠邊緣直接運行 LLM 工作負載有助於操作員更快地審查生產問題,並在不同班次之間提供更高的一致性回應。 LLM-1U-RPL 支援這種方法,可整合到現有機架基礎設施中,而無需更改周邊設定,同時保持現場處理。總體而言,這顯示了本地化 LLM 推理如何作為更廣泛的工業 4.0 採納的一部分,支援日常故障排除工作流程。有關 LLM-1U-RPL 的更多資訊,請透過 sales@premioinc.com 聯絡產品專家。