让 DJL 开始工作

两件值得了解的事:智能体如何执行一项任务,以及如何为它配置一个在你自己设备上运行的模型。

描述任务,并始终掌控

DJL 会把请求拆解为有序步骤,公开运行每个工具,并在改动触及你的文件之前停下来等待批准。

  1. 描述任务

    用中文或英文写下你的需求。两种语言共享同一上下文,因此可以中途切换而无需重述。

  2. 阅读计划

    工作会被拆解为有序、清晰的步骤,在任何操作运行之前供你阅读。

  3. 观察工具

    每个工具都在沙箱中执行,并实时输出,任何事都不会在你看不到的地方发生。

  4. 审查差异

    每一处改动都会等你决定:批准并应用、要求修改,或取消并回滚。

在你批准之前,任何内容都不会写入你的项目。

在你自己的硬件上运行模型

DJL 会判断你的电脑能够运行什么,然后自行安装并启动运行时。无需终端,也无需管理员密码。

本地模型管理位于 DJL 桌面应用中。

  1. 打开桌面应用

    下载对应平台的 DJL 并启动。

  2. 进入设置 → 本地模型

    位于「私有推理」分组下。

  3. 查看 DJL 的检测结果

    它会报告你的处理器、显卡与内存,并推荐仍能保持流畅的最大模型——有意比你的机器勉强装得下的规格低一档。

  4. 安装并启动运行时

    选择 Ollama 或 LM Studio。DJL 会完成下载、启动本地服务并建立连接。

  5. 选择模型

    安装完成后,在模型选择器中选中它,然后描述你的第一个任务。

两种运行时

Ollama

DJL 会为你安装、启动并连接 Ollama。无需终端或管理员密码。

LM Studio

只需安装一次 LM Studio,之后 DJL 即可启动并管理它的本地服务。

精选模型

DJL 会依据你的硬件推荐其中之一,你也随时可以另选。

模型内存下载体积可驱动智能体
Qwen3 1.7B4 GB1.4 GB仅对话
Qwen3.5 2B8 GB1.9 GB仅对话
Granite 4.1 3B8 GB2.1 GB可以
Qwen2.5 Coder 7B16 GB4.36 GB可以
GPT-OSS 20B16 GB13 GB可以
Qwen3 Coder 30B32 GB19 GB可以

「仅对话」就是只能对话

Qwen3 1.7B 与 Qwen3.5 2B 回答问题不错,但太小,无法完整维持一轮工具调用循环。若交给它们需要修改文件的任务,它们会静默停滞而不会报错。要做实际工作,请选择标记为「可驱动智能体」的模型——Granite 4.1 3B 是其中最小的一个,8 GB 内存即可运行。

如果工具失效了

即使模型本身够强,也需要加载足够的上下文才能使用工具。当 DJL 提示当前上下文下仅能对话时,请以更大的上下文窗口重新加载该模型,工具便会恢复。

使用你自己的模型

精选列表只是起点,而非限制。你可以安装任意 Ollama 标签、LM Studio 目录 ID,或精确的 Hugging Face 模型链接。

哪些内容留在你的设备上

推理在本地进行:提示词、代码上下文与输出都不会发送给托管的模型服务商。DJL 只连接固定的本地回环地址(127.0.0.1),绝不会把任一运行时暴露到你的网络中。你批准的工具仍可自行访问网络。

随时可以开始

下载 DJL,为它配置一个在你所在之处运行的模型。

下载 macOS 版