让AI成为你的超能力。 本地部署 / 免费白嫖 / 自制软件。

让AI成为你的超能力。 本地部署 / 免费白嫖 / 自制软件。

本地跑、免费用、自己造;各挑一篇,不让你在文章堆里迷路。
遇到问题,先找工具;找不到,就自己写一个。多少有点不服气。
采样参数改为读取模型自带的推荐值(GGUF general.sampling.),不再按模型名查表覆盖;模型没有声明的参数交给推理引擎默认值。经实测保留 presencepenalty(去掉后同一题目反而写不完)。长文件的分段建议改为按输出额度与实测生成速度共同推导,并去掉了「超出建议即中止」的硬性限制——连贯产物可以一次写完,慢速模…
免费大模型 API 发现、核验与本地统一接入工具。本版重点修复免费路由遇到额度限制后未继续换路的问题,并包含近期客户端兼容性修复。
本版为非正式初步构建:消除拖动片段时的闪动。
双击集数直接开始播放,不用再先选中、再点播放按钮;单集上点右键:播放、字幕体检、重跑字幕、强制 Whisper、字幕恢复默认。
想找哪次踩坑,直接搜;我的记性不一定比搜索框好。

Ollama 半年前就把 Mac 推理换成了 MLX 内核,现在冒出一堆自称更快的挑战者。我没跑实测,只把四家自己公布的跑分摆到一张桌子上——结果是:谁也没跟谁跑同一套题。

GPT-6 Astra 的真正变化,不是聊天分数再涨一点,而是电脑操作、长任务和高风险能力同时进入产品。本文按 OpenAI 官方资料拆解可用范围、API 成本、安全边界和普通人的选型方法。

把分散的免费 API 变成一个本地入口:先看官方证据,再用自己的 Key 真测路由,最后让 Cursor、Cline 和 OpenCode 自动换到还能用的模型。Windows 与 Mac 已可用,平台差异也写清楚。

9 月 2 日谷歌一口气发了 3.8 Flash 和 3.8 Flash Cyber。同一个核心,两副面孔:一个便宜好用人人能上,一个专治漏洞却只给可信防御方。有意思的不是谁更强,是这条分界线画在哪。

DeepSeek把视觉变成Agent的感知入口,并开放305B权重。最新最小视觉GGUF仍约67.8GiB:64GB Mac今天不适合稳定部署。本文按官方资料与文件实算,不做本机运行冒充。

Fable 5.1 与 Mythos 5.1 是同一个底层模型,却被拆成大众版和可信访问版。基础单价没降,缓存读取却便宜75%;真正改变的是长时程Agent的任务经济性、安全边界与接入方式。

Qwen3.8 Flash Next 的 125B 主模型每个 token 只激活约 6B 参数。借助 Atomic M64 特制分片与 LocalBrain,我在 64GB M5 Pro Mac 上完成了文本、工具调用、视觉和持续生成实测。

达芬奇键位、207 条命令、AI 助理改真实工程。45 MB 本地运行。初步构建预览版,免费。

我把 Mac 上分散的本地模型、转写、生图、视频、文档和 MCP,收进一个能下载、启停、对话和交付文件的本地工作台。

免费大模型 API 不缺,缺的是有人替你持续验证。收录 103 家,实测 68 家能用。预览版。

GLM-5.3-Flash、Qwen3.8 与 Coding GLM 免费接口复核:能不能用、怎么接、额度与隐私风险一次看清。

AgentPad13 把一台卖断货的 Codex Micro 拆成了可复用的方法:成品可以买空,公开设计却不会缺货。

Qwen4 架构预演开放权重:每个 token 激活 6B,但当前最小 GGUF 仍有 72.55GB。本文只按官方仓库、配置与文件清单分析,没有本机实测。

8 月 20 日深夜,OpenRouter 多了一行 stealth/ox-alpha。没有公司、没有仓库、没有名字,两天冲上调用量第一。104 万上下文、能看视频、完全免费——代价写在页面顶上。

harness 不是外壳是挽具;连 agent 循环都是插件,所以模型能换成本机的——附两份配置文件的实际写法与四处不写就翻车的字段。

能直接调用的免费接口、特色与限制

从角色资产、分镜绑定拆到生成、配音与剪辑,重算 4 分钟卡通的现金和时间成本;同时给出本地开源、免费云额度和混合路线的工具、用法、效果与边界。

六个本地工具、一个本地模型,两次点击接入;真正麻烦的不是安装,而是那些填错后仍像正常工作的默认值。
装机、本地模型、Agent 和 48 小时发布雷达;能点、能查、能直接用。
不抢 AI 主线的镜头,但做都做了,有用就拿走。