让AI成为你的超能力。 本地部署 / 免费白嫖 / 自制软件。

让AI成为你的超能力。 本地部署 / 免费白嫖 / 自制软件。

本地跑、免费用、自己造;各挑一篇,不让你在文章堆里迷路。
遇到问题,先找工具;找不到,就自己写一个。多少有点不服气。
新增 9 个低内存小模型(1.2.66):发现页新分组「2026-09-13 加入 LocalBrain」,收录今年发布的 MiniCPM5 2B、Qwen3.5 4B / 9B、Granite 4.2 3B / 8B、Gemma 4 12B / E4B 官方量化感知训练版,以及把 27B 压到 1-bit 和三值的 Bonsai 2…
免费大模型 API 发现、核验与本地统一接入工具。本版重点修复免费路由遇到额度限制后未继续换路的问题,并包含近期客户端兼容性修复。
本版为非正式初步构建:消除拖动片段时的闪动。
双击集数直接开始播放,不用再先选中、再点播放按钮;单集上点右键:播放、字幕体检、重跑字幕、强制 Whisper、字幕恢复默认。
想找哪次踩坑,直接搜;我的记性不一定比搜索框好。

64GB Mac 上的 Qwen3.8-Flash-Next 连跑五道离线网页难题:1 题交付、3 题可运行、1 题放弃。每次超时、崩溃和长上下文失速,最终都变成了 LocalBrain 的通用修复。

llama.cpp 0.4 用懒加载、流式量化和 Apple RDMA 改写了大模型的内存边界。但 LocalBrain 的 64GB Mac 记录证明:文件大于内存可以启动,不等于长上下文也能满速跑。

MiniCPM5-2B 把 13 万上下文、Agent 训练和官方 GGUF/MLX 一起塞进 2.52B 参数;真正的看点不是越级跑分,而是它有没有资格成为本地软件里的常驻执行器。

我拿四个真实产品图标做了三轮测试:一次融合、单点改图、透明贴纸。它进步最大的不是画得更艳,而是终于更像一个能反复沟通的视觉导演。

只监听 127.0.0.1,不代表浏览器里的网页碰不到它。三个近期官方安全公告,加一组完全隔离的 CORS 实测,拆开本地 AI 最容易被误解的安全边界。

从安装、快捷键到编程助手与本地模型,讲清 Omarchy 的特色和上手边界。

六题制作复盘与公开评测对照,附免费雨夜推理小游戏、完整线索和答案。

Ollama 半年前就把 Mac 推理换成了 MLX 内核,现在冒出一堆自称更快的挑战者。我没跑实测,只把四家自己公布的跑分摆到一张桌子上——结果是:谁也没跟谁跑同一套题。

GPT-6 Astra 的真正变化,不是聊天分数再涨一点,而是电脑操作、长任务和高风险能力同时进入产品。本文按 OpenAI 官方资料拆解可用范围、API 成本、安全边界和普通人的选型方法。

不讨论“软件有没有 Windows 版”这种表面问题,而是回答两件实际的事:8 GB NVIDIA 显卡能把哪些本地模型和工具跑起来,Mac 的统一内存与完整多媒体链又强在哪里。

把分散的免费 API 变成一个本地入口:先看官方证据,再用自己的 Key 真测路由,最后让 Cursor、Cline 和 OpenCode 自动换到还能用的模型。Windows 与 Mac 已可用,平台差异也写清楚。

9 月 2 日谷歌一口气发了 3.8 Flash 和 3.8 Flash Cyber。同一个核心,两副面孔:一个便宜好用人人能上,一个专治漏洞却只给可信防御方。有意思的不是谁更强,是这条分界线画在哪。

DeepSeek把视觉变成Agent的感知入口,并开放305B权重。最新最小视觉GGUF仍约67.8GiB:64GB Mac今天不适合稳定部署。本文按官方资料与文件实算,不做本机运行冒充。

Fable 5.1 与 Mythos 5.1 是同一个底层模型,却被拆成大众版和可信访问版。基础单价没降,缓存读取却便宜75%;真正改变的是长时程Agent的任务经济性、安全边界与接入方式。

Qwen3.8 Flash Next 的 125B 主模型每个 token 只激活约 6B 参数。借助 Atomic M64 特制分片与 LocalBrain,我在 64GB M5 Pro Mac 上完成了文本、工具调用、视觉和持续生成实测。

达芬奇键位、207 条命令、AI 助理改真实工程。45 MB 本地运行。初步构建预览版,免费。

我把 Mac 上分散的本地模型、转写、生图、视频、文档和 MCP,收进一个能下载、启停、对话和交付文件的本地工作台。

免费大模型 API 不缺,缺的是有人替你持续验证。收录 103 家,实测 68 家能用。预览版。
装机、本地模型、Agent 和 48 小时发布雷达;能点、能查、能直接用。
不抢 AI 主线的镜头,但做都做了,有用就拿走。