鹓络
鹓络

本地优先的 AI 操作系统

你的 AI · 属于你自己

所有用户数据默认本地存储。云端仅承担平台服务 —— 登录、授权、更新、插件索引、匿名反馈。

查看发布计划

支持 macOS · Windows · Linux · 零第三方运行时依赖

yuan — chat
$ pnpm start
→ Web UI http://127.0.0.1:4321
→ 模型列表 (3): qwen2.5-0.5b · llama-3.2-1b · mistral-7b
[user]
帮我写一首关于秋天的诗
[yuan · qwen2.5-0.5b]
秋意浓时落叶黄,
寒霜染尽万山岗。
CORE FEATURES

核心特性

垂直切片 MVP · 模型管理 + 流式聊天 + LoRA 训练,全部跑在本机

模型管理

3 个预置模型;下载(模拟进度/校验)、加载、卸载(单槽位)、删除,状态机事件实时推送。

💬

流式聊天

内置模拟引擎(Mock Engine)逐 token 流式输出,支持中英文、会话延续、停止生成。

🎯

LoRA 训练

2 个预置数据集;queued→preparing→training→saving→completed 全生命周期,支持暂停/继续/取消。

📡

事件流 SSE

所有状态变化通过 /api/v1/events 推送,前端实时响应。

🌐

中英双语

右上角一键切换,前端以 i18n key 组织文案。

🔓

零运行时依赖

后端仅用 node:http,前端用原生 Web API,AI 核心用 node:fs/os/crypto

🔒

数据 100% 本地

对话、训练数据、模型权重 —— 全部存在你的设备上。

本地
对话内容
本地
训练数据
本地
模型权重
本地
微调结果
本地
API keys

云端仅:登录、授权、更新、插件索引、匿名反馈

ARCHITECTURE

为本地优先而设计

契约先行的模块化架构。所有跨模块类型与错误码都在 @yuan/protocol,三个模块 import 同一份契约。

  • 状态机唯一强制方:ai-core 主导状态迁移,前端只消费事件流,不校验迁移合法性
  • Result 统一返回:所有 RPC/HTTP/IPC 接口返回 { ok:true, data } | { ok:false, error }
  • 真实引擎适配位:InferenceEngine 接口即适配器,接 llama.cpp / vLLM / MLX 时实现该接口即可
// 一次会话
const chat = await fetch('/api/v1/chat', {
method: 'POST',
body: JSON.stringify({
model: 'qwen2.5-0.5b',
messages: [...],
stream: true,
})
const reader = chat.body.getReader()
// ↓ 逐 token 推送
data: {"token":"秋"}
data: {"token":"意"}
data: {"token":"浓"}

开始使用 Yuan

桌面端筹备中,敬请期待。

查看发布计划