AI教程2026年8月14日vLLM vs Ollama:2026 年生产级 LLM 服务选型指南深入对比 vLLM 与 Ollama 在 2026 年的大模型推理架构、并发性能基准以及生产环境下的决策框架。阅读全文 →
AI教程2026年8月13日使用本地 LLM 和 Gemma 构建多模态工作流本指南详细介绍了如何利用 Ollama、Gemma 模型和结构化 JSON 输出实现本地多模态 AI 工作流,旨在为生产级应用提供高性能、隐私保护的解决方案。阅读全文 →
AI教程2026年8月4日使用 Python 和 Ollama 构建自动化 CLI 代理本教程将详细介绍如何利用 Python 和 Ollama 构建一个完全本地化、保护隐私的 CLI 智能代理,涵盖 ReAct 框架实现、工具调用以及通过 n1n.ai 进行生产级扩展的方案。阅读全文 →
AI教程2026年7月28日Ollama 本地运行大语言模型全指南:隐私、零成本与完全控制本教程深入探讨如何利用 Ollama 在本地部署 LLM,涵盖硬件选型、GGUF 量化技术、私有化 RAG 架构实现以及企业级扩展方案,助你实现 AI 自由。阅读全文 →
AI教程2026年6月29日在 OCI 容器实例上运行 Ollama:5 分钟构建私有 LLM API,无需 Kubernetes了解如何在 Oracle Cloud Infrastructure (OCI) 上使用 Ollama 和容器实例部署私有且兼容 OpenAI 的 LLM 终点,无需复杂的 Kubernetes 运维。阅读全文 →
AI教程2026年6月29日构建全离线 RAG 智能体:使用 LangGraph Ollama 和嵌入式 Qdrant本教程将教你如何使用 LangGraph、Ollama 和 Qdrant 嵌入式模式,在无需任何 API 密钥的情况下,在本地电脑上构建一个生产级的 RAG 智能体。阅读全文 →
AI教程2026年6月27日从本地 LLM 到工具调用智能体:使用 Gemma 2、Ollama 和 OpenAI Agents SDK 构建研究助手本教程详细介绍了如何将 Google Gemma 2 等本地模型转化为具备联网搜索能力的自主智能体(Agent),涵盖 Ollama 配置、OpenAI SDK 集成以及 Tavily 搜索工具的应用。阅读全文 →
AI教程2026年6月23日构建基于 Gemma 4 和 OpenCode 的本地 AI 编程助手本教程详细介绍了如何利用 Ollama、Gemma 4 和 OpenCode 框架,在本地环境中搭建一个安全、高效且完全私有的 AI 编程助手,实现零延迟、高隐私的代码开发。阅读全文 →
AI教程2026年5月28日本地 LLM 工作流优化:Ollama 量化机制、Light-Agent CLI 与 Qwen 3.7 Max 全解析本文深入探讨本地 AI 领域的最新进展,包括 Ollama 的默认量化策略、专为本地编码设计的 Light-Agent v0.2.1,以及 Qwen 3.7 Max 在多模态生成方面的卓越表现。阅读全文 →
AI教程2026年5月27日Ollama v0.30.0、Qwen3.5 35B 与 WebGPU 上的 1-bit 多模态 AI深入探讨本地 AI 的最新进展:Ollama 改进的互操作性、具备原生多轮对话保存能力的 Qwen3.5 35B 模型的发布,以及通过 WebGPU 在浏览器中运行的突破性 1-bit 文本生成图像模型。阅读全文 →
AI教程2026年5月6日部署 Gemma 4 MTP 与多模态 AI 本地化指南深度解析 Google Gemma 4 的多 Token 预测技术、Microsoft VibeVoice 的 C++ 移植版以及 Ollama 离线桌面层,助力开发者构建高效本地 AI 生态。阅读全文 →
AI教程2026年4月16日本地推理大突破:1-bit Bonsai WebGPU、Ollama 多智能体与 Gemma4 26B 实战探索本地大模型推理的最新革命:从通过 WebGPU 在浏览器运行 1-bit 模型,到使用 Ollama 和 Qwen3-Coder 构建复杂的多智能体系统。阅读全文 →