分类 AI大模型 下的文章

极致压榨 96G 显存:Qwen3.5 122B (MoE) 大模型本地部署优化指南在本地运行超大规模模型(如 Qwen3.5 122B A10B)时,硬件性能的充分发挥往往取决于细微的参数配置。本文将针对 AMD 395max(128G 内存,其中 96G 分配为显存)这一典型硬件环境,分享如何解决主机内存溢出(OOM)、显存利用率不足以及模型崩溃等...

10分钟跑通 OpenClaw:本地部署 + 模型配置完整教程(普通用户版)很多人看完 OpenClaw 的介绍后,可能会觉得“怎么跑不起来?”这篇文章的目标是:在最短的时间内,使用最简单的方法跑通 OpenClaw。一、环境准备(3分钟)1)基础要求首先,确保你有以下基础工具:- 操作系统:Windows / macOS / Linux(支持多平台)...

OpenClaw 是什么?一文讲清 AI Agent 框架的本质在过去一年里,“AI Agent”成为技术圈最热门的方向之一,而 OpenClaw 也逐渐走红。但一个现实问题是:大多数教程只教你“怎么用”,却没有讲清“它到底是什么”。这篇文章从架构层面 + 执行流程出发,帮你彻底理解:OpenClaw 在解决什么问题?Agent 的运行机制是什么?Op...

开源推荐 | ModelX RAG:基于 LangChain + Ollama 的企业级知识库系统最近开源了一个非常实用的项目 qyhua0/rag,名为 ModelX RAG。这是一个基于 LangChain v0.3 + FastAPI + Ollama + Vue3 构建的企业级 RAG(检索增强生成)知识库系统。如果你正在寻找一个可私有化部署、...

深度解析:Ollama 模型跨平台迁移与 GPU 加速失败原因全攻略(含实践教程)在大模型本地部署领域,Ollama 已成为 Windows、Linux 与 macOS 上最便捷的 LLM 运行方案之一。然而,许多开发者在 跨平台迁移(如 Win10 → Win11) 或 导入自定义模型 时,会遇到两个典型问题:模型虽能导入成功,但无法出现在模型列表模...

本地部署 DeepSeek R1 越狱版(DeepSeek-R1-Abliterated)详细教程:从原理到落地实战DeepSeek R1 在 2025 年已经成为开源大模型生态的重要组成部分,而社区出现的 DeepSeek-R1-Abliterated(越狱版) 更是因其“无审查、无过滤、强自由度”而受到本地部署爱好者的关注。本文将从 技术背景 → ...

国内下载大模型的极速通道:2大Hugging Face替代方案(2025推荐)关键词优化:Hugging Face 国内镜像、大模型下载、HF-Mirror、ModelScope、魔搭平台、中文大模型、免翻墙下载AI模型、国产AI平台、本地部署大模型🔍 为什么国内用户急需Hugging Face替代方案?在 AI 开发与研究中,大语言模型(LLM)的快...

让AI成为你的超级副驾:7个高效编码实战技巧在AI编程时代,会提问比会编码更重要。本文总结7个经过实战验证的AI协作技巧,助你告别“胡说八道”的AI,打造高效、可维护、可协作的智能开发流程。1. 用“目的+约束”结构化沟通1.1 精简但精准的Prompt公式结构化沟通的核心不是繁琐模板,而是 “目的 + 约束” 两要素:目的:你要做什么?(如“实现商品...