Intel Mac + AMD 独显跑 llama.cpp Vulkan 后端简记
发表于 2026-06-28
背景 Ollama 在 macOS 上只支持 Apple Silicon(M 系列)的 Metal 加速。Intel Mac 即使 …
背景 Ollama 在 macOS 上只支持 Apple Silicon(M 系列)的 Metal 加速。Intel Mac 即使 …
本文记录将 NVIDIA GR00T N1.7(3B VLA 模型)迁移到华为 Ascend 910B 进行分布式训练的全过程。从 …
一、背景 在华为昇腾 aarch64 服务器上基于 k3s 1.35.5 部署 MindCluster v26.0.0(原 Min …
DiT4DiT 是港科广团队在 StarVLA 基础上提出的视觉-动作模型(VAM),将视频生成 Diffusion Transf …
**相关资源:** 一、ms-swift 镜像制作 1.1 镜像下载 选择 8.5.0 分支的 CANN 镜像: > 镜像地 …
一、环境准备 基础镜像与 PyTorch 生态 使用 vllm-ascend 0.13.0.rc3 镜像作为基础环境: ffmpe …
一、背景与动机 在大规模企业文档处理的OCR场景中,需要对海量扫描件/文档图片进行高并发识别。单实例PaddleOCR面对大量请求 …
Kubernetes(K8s)是一个生产级的容器编排平台,提供分布式系统运行所需的弹性伸缩、故障转移和部署管理能力。其核心能力通过 …
EvalScope 离线评测部署简记(华为910B ARM + OpenAI 兼容接口) 背景 在华为 910B (ARM64) …
一、背景概述 Pi-0.5 是 Physical Intelligence 团队推出的视觉-语言-动作(VLA)具身智能模型,采用 …