“写笔记”支持四种格式——Word 文档、Excel 表格、Markdown、纯文本,起稿或二次编辑时都能随时切换,同一篇笔记想用哪种形态来记,都由你说了算。
md、txt、csv、json 这类纯文本则原样载入,不做多余加工。拿一张现成的表倒进来、改几笔、再导出去,等于白用一台免费的格式转换器。
要带走就在右上角点“下载”,可导出 PDF、Word、Markdown、Excel、TXT 等格式;列表卡片“⋯”菜单里,也有同样的下载入口。
在“工具”页点“+ 上传工具”即可发布:填好名称与链接,再用 Markdown 把使用方法写清楚——能解决什么问题、怎么装、怎么用,比堆介绍实在。
要分发安装包就一并上传压缩包(ZIP、RAR、7Z、TAR.GZ,最大 35MB),别人在详情页一键下载;只放链接不带附件也可以。
工具按大家的收藏热度排序,好用的自然会被顶上来。发布后可在详情页或卡片菜单里编辑、下架。
写笔记时勾上“隐藏”,这篇就只存在于你自己的账号里:不进列表、不进搜索、不上首页精选,也不会出现在任何公开的页面,链接发给别人同样打不开。
适合放密码、草稿、日记这类只给自己看的内容;想公开,去“发布”打开它,把“隐藏”的勾去掉再保存,之后编辑会默认保持原状态,不会悄悄变回公开。
你的内容会同时保存在多个副本上,系统定期做备份与完整性校验,再配合异地容灾机制:就算某台机器出问题,数据也不会丢,可以长期放心存放;特别重要的资料,仍建议你另外再留一份备份。
全站跑在容器化、模块化的现代架构上,更新、部署、回滚都很快,扩展性和稳定性都按长期运营的标准来设计(Built for reliability, designed to scale)。
这个网站最早只是一个人的笔记仓库,后来慢慢长成现在的知识中枢。设计上很克制——没有广告、没有追踪、没有推荐算法,只是干干净净地存放一些东西;既然做好了,就公开出来,万一有人用得上呢。
不做大而全,不做平台梦,保持简单、保持克制、保持好奇。所有内容都由用户贡献、由用户维护:不会突然冒出付费墙,不会在角落塞广告位,也不会把你的数据卖给第三方。
产品会持续迭代,站内日志页记录着每一次改动,改了什么都有迹可循;想了解这个站是怎么一步步走到今天的,翻翻日志就能看到来龙去脉。
如果在这里看到涉嫌违规的内容,点对应卡片右侧的“举报”按钮就能提交,我们会尽快核实处理;也谢谢你花一点时间,一起把这里维护干净。
Talos:用你的闲置GPU为开源模型打工,躺着赚取算力报酬
Talos 是一个开源 GPU Worker 客户端,通过 WebSocket 连接 Talos 网络,利用本地闲置算力运行开源模型推理任务,并依据在线时长获取收益。
一、项目背景:AI 算力的“共享经济”缺口
随着大语言模型(LLM)和扩散模型的爆发,个人开发者和小团队往往面临两难:要么租用昂贵的云端 GPU(如 A100、H100),要么忍受本地低端显卡的缓慢推理。与此同时,大量拥有 RTX 3090/4090、甚至专业卡的用户,在非游戏或非训练时段,GPU 处于闲置状态。
Talos 项目正是瞄准了这一“算力供需错配”的痛点——它不是一个训练平台,而是一个分布式推理市场的客户端。用户只需安装一个轻量级 Python 客户端,绑定 Talos 网络账号,即可自动接收来自第三方的开源模型推理请求(如 Llama、Stable Diffusion 等),在本地执行后返回结果,并根据在线时长获得报酬。
二、快速上手:从安装到第一笔收入
2.1 环境要求
- Python 3.10+
- 一块支持 CUDA 的 NVIDIA GPU(显存建议 ≥ 8GB)
- 已注册的 Talos 网络账号(需从官网获取 API Key)
2.2 安装步骤
bash
克隆仓库
git clone https://github.com/jmerelnyc/Talos.git
cd Talos
创建虚拟环境(推荐)
python -m venv venv
source venv/bin/activate # Windows 使用 venv\Scripts\activate
安装依赖(自动安装 PyTorch、transformers 等)
pip install -r requirements.txt
2.3 配置与运行
在项目根目录创建 .env 文件:
TALOS_API_KEY=your_api_key_here
TALOS_WORKER_ID=your_worker_name
启动 Worker:
bash
python worker.py
正常启动后,终端会显示:
[INFO] Connected to Talos relay at wss://relay.talos.network
[INFO] Worker 'my-gpu-01' registered. Waiting for jobs...
2.4 实际推理示例(后台自动执行)
当 Talos 网络分配一个 Llama-3-8B 的推理任务时,客户端会自动加载模型并推理,无需用户手动干预。日志大致如下:
[INFO] Received job: j_abc123, model: meta-llama/Meta-Llama-3-8B
[INFO] Loading model... (约 30 秒)
[INFO] Inference completed in 2.3s, tokens: 512
[INFO] Result sent to relay. Uptime +15 min credited.
三、核心架构与设计亮点
3.1 基于 WebSocket 的长连接通信
与传统的 HTTP 轮询不同,Talos 采用 WebSocket 维持与中继服务器的长连接,优势在于:
- 低延迟:任务下发几乎实时,无需轮询开销。
- 双向通信:Worker 可以主动上报状态(如显存占用、当前任务进度)。
- 断线重连:内置心跳机制和指数退避重连,支持不稳定网络环境。
3.2 智能模型调度与资源隔离
- 按需加载:客户端不会预加载所有模型,而是根据任务需求动态加载和卸载,避免显存浪费。
- 并发控制:同一时刻只执行一个推理任务,避免多任务争抢显存导致 OOM。
- 自动降级:如果本地显存不足以运行请求的模型(如 70B 模型要求 48GB 显存),Worker 会优雅拒绝任务并通知调度器。
3.3 透明化收益计算
收益与在线时长直接挂钩,而非任务数量。这意味着:
- 即使没有任务(空闲等待),只要保持 WebSocket 连接,也会累积时长。
- 避免因网络波动导致的任务失败而扣减收益。
- 收益按小时结算,通过 Talos 官网面板可查看实时收入。
四、适用场景分析
| 用户类型 | 场景 | 价值 |
|---|---|---|
| 个人极客 | 拥有 RTX 3090/4090,晚上睡觉时闲置 | 每月额外收入 20-50 美元,覆盖电费 |
| 小团队 | 办公室有多张 GPU,白天用于开发,夜间闲置 | 最大化资产利用率 |
| 云服务商 | 未售出的 GPU 实例 | 作为备用算力池,按需接入 |
| 模型开发者 | 需要低成本测试开源模型推理 | 可以同时作为 Worker 和任务发布者(同一账号) |
五、同类项目对比
| 特性 | Talos | RunPod | Together.ai | Banana Dev |
|---|---|---|---|---|
| 开源 | ✅ 完全开源 | ❌ 闭源 | ❌ 闭源 | ❌ 闭源 |
| 客户端形态 | Python CLI 守护进程 | Docker 容器 | 无本地客户端 | 无本地客户端 |
| 算力来源 | 个人 GPU(去中心化) | 数据中心(中心化) | 数据中心 | 数据中心 |
| 收益模式 | 按在线时长 | 按实例租用费 | 按 API 调用量 | 按 API 调用量 |
| 模型控制权 | 完全由调度器分配 | 用户选择模型 | 用户选择模型 | 用户选择模型 |
| 最低门槛 | 一台有 GPU 的电脑 | 需 Docker 基础 | 无需硬件 | 无需硬件 |
Talos 的核心差异点:
- 去中心化精神:任何拥有 GPU 的个人都可成为算力提供方,而非仅限大型数据中心。
- 收益透明:代码完全开源,可审计收益计算逻辑,无暗箱操作。
- 低门槛:不需要 Docker、Kubernetes 等复杂基础设施,
pip install即可运行。
六、潜在局限与改进方向
- 网络依赖性:断网会导致收益暂停,且重连期间可能错过任务。
- 模型兼容性:目前主要支持 Hugging Face Transformers 生态的模型,对 vLLM、TGI 等高性能推理框架尚未集成。
- 收益波动:目前网络处于早期,任务密度不高,实际收益可能低于预期。
- 隐私风险:虽然只运行开源模型,但用户仍需信任 Talos 网络不会下发恶意代码(客户端有模型白名单机制,但需手动配置)。
七、总结与推荐
Talos 是一个极具潜力的分布式推理网络客户端。它巧妙地将共享经济模式引入 AI 算力领域,让普通 GPU 拥有者也能参与 AI 基础设施的建设并获利。对于技术爱好者来说,这不仅是一个赚钱工具,更是一个学习 WebSocket 通信、分布式系统、模型推理流水线的绝佳实战项目。
如果你是以下人群,强烈推荐尝试:
- 有闲置 NVIDIA GPU 的个人开发者
- 对“去中心化算力”概念感兴趣的研究者
- 希望低成本参与 AI 推理生态的用户