003 / 服务器
给 Xcode 装一个国产 AI 代码助手

让你的Xcode拥有国产AI代码助手,32GB Mac Silicon完全够用。
前提条件
- ✅ macOS + Apple Silicon(M1/M2/M3/M4)
- ✅ 32GB 统一内存(14B模型推荐,7B也能跑)
- ✅ Xcode 26.6 或更高版本
- ✅ 网络通畅(首次下载模型约8-9GB)
第一步:安装 Ollama
方式一:官网下载(推荐新手)
- 打开浏览器访问 https://ollama.com
- 点击 Download 按钮,选择 macOS 版本
- 下载完成后双击
.dmg文件 - 将 Ollama 拖入 Applications 文件夹
- 从 Launchpad 启动 Ollama,首次会要求授权
方式二:命令行安装(需要Homebrew)
brew install ollama
启动 Ollama 服务
## 前台运行(关闭窗口就停了)
ollama serve
## 后台运行(推荐)
ollama serve &
## 验证服务是否启动
curl http://localhost:11434
## 应该返回 "Ollama is running"
设置开机自启(可选)
## 创建 LaunchAgent
mkdir -p ~/Library/LaunchAgents
cat > ~/Library/LaunchAgents/com.ollama.plist << 'EOF'
<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE plist PUBLIC "-//Apple//DTD PLIST 1.0//EN" "http://www.apple.com/DTDs/PropertyList-1.0.dtd">
<plist version="1.0">
<dict>
<key>Label</key>
<string>com.ollama</string>
<key>ProgramArguments</key>
<array>
<string>/usr/local/bin/ollama</string>
<string>serve</string>
</array>
<key>RunAtLoad</key>
<true/>
<key>KeepAlive</key>
<true/>
</dict>
</plist>
EOF
## 加载服务
launchctl load ~/Library/LaunchAgents/com.ollama.plist
第二步:拉取 Qwen2.5-Coder 模型
## 推荐:14B版本(代码能力强,内存约12GB)
ollama pull qwen2.5-coder:14b
## 备选:7B版本(内存约5.7GB,更轻量)
ollama pull qwen2.5-coder:7b
## 激进:32B版本(最强,但内存约23GB,Xcode同时开会紧张)
ollama pull qwen2.5-coder:32b
验证模型
## 进入对话模式
ollama run qwen2.5-coder:14b
## 测试提问
> 用SwiftUI写一个计数器
## 能正常回答就说明OK,输入 /bye 退出
查看已下载的模型
ollama list
删除不需要的模型
ollama rm qwen2.5-coder:7b
第三步:在 Xcode 中配置 AI
3.1 打开设置
- 顶部菜单:Xcode → Settings
- 快捷键:
⌘ + , - 找到 Intelligence 标签页
3.2 配置 Model Provider(代码补全/问答)
- 点击 Add a Model Provider
- 填写:
| 字段 | 值 |
|---|---|
| Name | 本地Qwen(随便起) |
| Endpoint | http://localhost:11434 |
| Model | qwen2.5-coder:14b |
- 点击保存
3.3 配置 Chat Provider(聊天式AI助手)
- 点击 Add a Chat Provider
- 填写:
| 字段 | 值 |
|---|---|
| Name | Qwen Chat |
| Endpoint | http://localhost:11434 |
| Model | qwen2.5-coder:14b |
- 点击保存
3.4 验证配置
- 在 Xcode 中打开一个 Swift 文件
- 选中一段代码,查看右键菜单或 Editor → AI 是否有选项
- 打开聊天窗口,确认能看到你配置的 Provider
第四步:日常使用
代码问答
- 选中代码 → 右键 → AI 相关选项
- 或在 Chat 窗口直接提问
常见用法示例
"解释这段代码的作用"
"把这个函数改成异步的"
"给这个列表加上动画效果"
"这段代码有个bug,帮我找找"
"帮我写一个UserDefaults的工具类"
常见问题
Q: Ollama 服务连不上?
## 检查Ollama是否在运行
ps aux | grep ollama
## 检查端口是否被占用
lsof -i :11434
## 重新启动
ollama serve
Q: Xcode 提示找不到模型?
确认模型名称拼写正确:
ollama list
## 显示 qwen2.5-coder:14b 就填这个
Q: 响应很慢或卡顿?
- 14B模型运行时约占12GB内存,Xcode本身也要几个GB
- 如果卡顿,换7B版本:
ollama pull qwen2.5-coder:7b - 关掉其他不用的应用释放内存
Q: 模型回答质量不好?
- 确保问的是具体、有上下文的问题
- 选中代码后再提问,让AI能看到上下文
- 14B比7B质量好很多,内存够的话优先14B
Q: 想切换模型怎么办?
## 下载新模型
ollama pull qwen2.5-coder:32b
## Xcode设置里把Model字段改成新的模型名即可
内存占用参考
| 模型 | 内存占用 | 32GB Mac状态 |
|---|---|---|
| 7B (Q4_K_M) | ~5.7 GB | 轻松,剩26GB |
| 14B (Q4_K_M) | ~12.0 GB | 舒服,剩20GB |
| 32B (Q4_K_M) | ~23.0 GB | 能跑,剩9GB偏紧 |
更新模型
## 拉取最新版本(会自动覆盖旧版)
ollama pull qwen2.5-coder:14b
生成日期:2026-07-15 适用于 Xcode 26.6+ / Ollama / Qwen2.5-Coder