登录
推荐 文章 Go 技术 课程 下载 专题 AI
首页 >  AI训练模型  >  Ollama
Ollama本地大语言模型运行工具:支持Llama 2、DeepSeek-R1及多模态交互

Ollama

AI训练模型
86次浏览
2026-09-23

工具简介

Ollama是一款免费开源的本地LLM运行工具,支持macOS、Linux及Windows。提供Docker镜像、GPU加速及REST API,现已推出桌面端支持文件处理与多模态交互,保障数据隐私。

详细介绍

Ollama 是一款专为在本地计算机上高效运行大型语言模型(LLM)而设计的命令行工具。它允许用户轻松下载并在本地部署如 Llama 2、Code Llama 等主流模型,同时支持用户自定义创建专属模型。作为一个免费且开源的项目,Ollama 目前完美兼容 macOS 和 Linux 操作系统,并计划在未来全面支持 Windows 系统。

此外,Ollama 提供了官方认证的 Docker 镜像,极大地简化了通过 Docker 容器部署大型语言模型的流程。这一特性确保了所有与模型的交互均在本地环境中完成,无需将敏感或私有数据上传至第三方云服务,从而保障了数据安全。在性能方面,Ollama 在 macOS 和 Linux 平台上支持 GPU 硬件加速,并提供了简洁易用的命令行界面(CLI)以及用于应用程序集成的 REST API。

对于需要在本地环境中测试、实验或部署大语言模型的开发人员和研究人员而言,Ollama 是一个极具价值的工具,因为它摆脱了对外部云服务的依赖,实现了完全自主可控的运行环境。

最新版本的 Ollama 已正式推出适用于 macOS 和 Windows 的桌面客户端。新版本新增了文件处理能力及多模态交互功能,使得用户与本地大语言模型的互动变得更加直观、便捷和高效。

Ollama安装包获取

Ollama

获取Ollama安装包,扫码关注回复:Ollama

Ollama支持的模型

Ollama 内置了丰富的模型库,用户可以根据需求自由选择并安装所需的模型。目前平台已支持超过40种模型,且数量仍在持续增长中。以下是部分可供下载的热门开源模型示例:

模型参数大小文件大小下载运行命令
DeepSeek-R11.5B、7B、14B、32B等12-320GBollama run deepseek-r1
Neural Chat7B4.1GBollama run neural-chat
Starling7B4.1GBollama run starling-lm
Mistral7B4.1GBollama run mistral
Llama 27B3.8GBollama run llama2
Code Llama7B3.8GBollama run codellama
Llama 2 Uncensored7B3.8GBollama run llama2-uncensored
Llama 2 13B13B7.3GBollama run llama2:13b
Llama 2 70B70B39GBollama run llama2:70b
Orca Mini3B1.9GBollama run orca-mini
Vicuna7B3.8GBollama run vicuna

最新文章

前端状态更新频繁时,批处理与去抖分别解决什么

前端状态更新频繁时,批处理与去抖分别解决什么

前端状态更新频繁时,批处理负责合并同一调度窗口的重复提交,去抖负责等待连
Copy、CopyBuffer 与手写循环的差别主要在哪里

Copy、CopyBuffer 与手写循环的差别主要在哪里

Go 的 io.Copy 会优先使用源的 WriterTo 或目标的 R
Linux 负载高但 CPU 空闲,怎样区分 I/O 等待与锁等待

Linux 负载高但 CPU 空闲,怎样区分 I/O 等待与锁等待

Linux 负载高并不等于 CPU 已满。本文用 /proc/loada
通过 LimitedReader 防止未知响应体耗尽内存

通过 LimitedReader 防止未知响应体耗尽内存

Go HTTP 客户端面对未知或不可信响应体时,不应直接无界 io.Re
PHP Session 锁为什么会阻塞并发请求,怎样缩短持锁时间

PHP Session 锁为什么会阻塞并发请求,怎样缩短持锁时间

解释 PHP Session 文件锁让同一用户并发请求排队的原因,并用
Python import 很慢怎么分析:模块级副作用与延迟导入

Python import 很慢怎么分析:模块级副作用与延迟导入

Python import 很慢时,应先用 -X importtime