让 DJL 开始工作
两件值得了解的事:智能体如何执行一项任务,以及如何为它配置一个在你自己设备上运行的模型。
描述任务,并始终掌控
DJL 会把请求拆解为有序步骤,公开运行每个工具,并在改动触及你的文件之前停下来等待批准。
描述任务
用中文或英文写下你的需求。两种语言共享同一上下文,因此可以中途切换而无需重述。
阅读计划
工作会被拆解为有序、清晰的步骤,在任何操作运行之前供你阅读。
观察工具
每个工具都在沙箱中执行,并实时输出,任何事都不会在你看不到的地方发生。
审查差异
每一处改动都会等你决定:批准并应用、要求修改,或取消并回滚。
在你批准之前,任何内容都不会写入你的项目。
在你自己的硬件上运行模型
DJL 会判断你的电脑能够运行什么,然后自行安装并启动运行时。无需终端,也无需管理员密码。
本地模型管理位于 DJL 桌面应用中。
打开桌面应用
下载对应平台的 DJL 并启动。
进入设置 → 本地模型
位于「私有推理」分组下。
查看 DJL 的检测结果
它会报告你的处理器、显卡与内存,并推荐仍能保持流畅的最大模型——有意比你的机器勉强装得下的规格低一档。
安装并启动运行时
选择 Ollama 或 LM Studio。DJL 会完成下载、启动本地服务并建立连接。
选择模型
安装完成后,在模型选择器中选中它,然后描述你的第一个任务。
两种运行时
Ollama
DJL 会为你安装、启动并连接 Ollama。无需终端或管理员密码。
LM Studio
只需安装一次 LM Studio,之后 DJL 即可启动并管理它的本地服务。
精选模型
DJL 会依据你的硬件推荐其中之一,你也随时可以另选。
| 模型 | 内存 | 下载体积 | 可驱动智能体 |
|---|---|---|---|
| Qwen3 1.7B | 4 GB | 1.4 GB | 仅对话 |
| Qwen3.5 2B | 8 GB | 1.9 GB | 仅对话 |
| Granite 4.1 3B | 8 GB | 2.1 GB | 可以 |
| Qwen2.5 Coder 7B | 16 GB | 4.36 GB | 可以 |
| GPT-OSS 20B | 16 GB | 13 GB | 可以 |
| Qwen3 Coder 30B | 32 GB | 19 GB | 可以 |
「仅对话」就是只能对话
Qwen3 1.7B 与 Qwen3.5 2B 回答问题不错,但太小,无法完整维持一轮工具调用循环。若交给它们需要修改文件的任务,它们会静默停滞而不会报错。要做实际工作,请选择标记为「可驱动智能体」的模型——Granite 4.1 3B 是其中最小的一个,8 GB 内存即可运行。
如果工具失效了
即使模型本身够强,也需要加载足够的上下文才能使用工具。当 DJL 提示当前上下文下仅能对话时,请以更大的上下文窗口重新加载该模型,工具便会恢复。
使用你自己的模型
精选列表只是起点,而非限制。你可以安装任意 Ollama 标签、LM Studio 目录 ID,或精确的 Hugging Face 模型链接。
哪些内容留在你的设备上
推理在本地进行:提示词、代码上下文与输出都不会发送给托管的模型服务商。DJL 只连接固定的本地回环地址(127.0.0.1),绝不会把任一运行时暴露到你的网络中。你批准的工具仍可自行访问网络。
随时可以开始
下载 DJL,为它配置一个在你所在之处运行的模型。
下载 macOS 版