跳转至

Ollama

英特尔“芯”AI,赋能云边端|第六期:使用 Ollama 在 Core Ultra 高效部署 Qwen3:8b

自第一期起,YiCoreAI 平台凭借 YIAISTUDIO 利用 Arc A770 GPU 高效训练 YOLOv8/v11 和 Qwen-7B,到 YiCONNECT 基于 Kubernetes 实现智能管理,再到 YiEDGE 依托 Core Ultra NPU 实现 40ms 延迟推理,逐步构建云边端 AI 闭环。第五期更在 Ultra 5 125H iGPU 上部署 MedGemma 4B IT,验证便携性。

第六期,Ollama 驱动 Qwen3:8b 在 Core Ultra 上实现高效部署,延迟低至 35ms,准确率超 85%,功耗优化显著,赋能教育心理健康和医疗诊断。