MiniCPM5-2B 把 13 万上下文、Agent 训练和官方 GGUF/MLX 一起塞进 2.52B 参数;真正的看点不是越级跑分,而是它有没有资格成为本地软件里的常驻执行器。
黑粉科技 · 全部文章
返回首页第 2 / 4 页 · 每页 21 篇。 精彩依旧继续,我们等待着您。
只监听 127.0.0.1,不代表浏览器里的网页碰不到它。三个近期官方安全公告,加一组完全隔离的 CORS 实测,拆开本地 AI 最容易被误解的安全边界。
35B多模态智能体开源,在线端点当前免费;Mac容量够不等于运行时已经打通。
从安装、快捷键到编程助手与本地模型,讲清 Omarchy 的特色和上手边界。
六题制作复盘与公开评测对照,附免费雨夜推理小游戏、完整线索和答案。
Ollama 半年前就把 Mac 推理换成了 MLX 内核,现在冒出一堆自称更快的挑战者。我没跑实测,只把四家自己公布的跑分摆到一张桌子上——结果是:谁也没跟谁跑同一套题。
GPT-6 Astra 的真正变化,不是聊天分数再涨一点,而是电脑操作、长任务和高风险能力同时进入产品。本文按 OpenAI 官方资料拆解可用范围、API 成本、安全边界和普通人的选型方法。
不讨论“软件有没有 Windows 版”这种表面问题,而是回答两件实际的事:8 GB NVIDIA 显卡能把哪些本地模型和工具跑起来,Mac 的统一内存与完整多媒体链又强在哪里。
把分散的免费 API 变成一个本地入口:先看官方证据,再用自己的 Key 真测路由,最后让 Cursor、Cline 和 OpenCode 自动换到还能用的模型。Windows 与 Mac 已可用,平台差异也写清楚。
9 月 2 日谷歌一口气发了 3.8 Flash 和 3.8 Flash Cyber。同一个核心,两副面孔:一个便宜好用人人能上,一个专治漏洞却只给可信防御方。有意思的不是谁更强,是这条分界线画在哪。
DeepSeek把视觉变成Agent的感知入口,并开放305B权重。最新最小视觉GGUF仍约67.8GiB:64GB Mac今天不适合稳定部署。本文按官方资料与文件实算,不做本机运行冒充。
Fable 5.1 与 Mythos 5.1 是同一个底层模型,却被拆成大众版和可信访问版。基础单价没降,缓存读取却便宜75%;真正改变的是长时程Agent的任务经济性、安全边界与接入方式。
Qwen3.8 Flash Next 的 125B 主模型每个 token 只激活约 6B 参数。借助 Atomic M64 特制分片与 LocalBrain,我在 64GB M5 Pro Mac 上完成了文本、工具调用、视觉和持续生成实测。
我把 Mac 上分散的本地模型、转写、生图、视频、文档和 MCP,收进一个能下载、启停、对话、交付文件,还能自己清理缓存的本地工作台。1.4.8 新增第二个本地视频引擎 LTX-2.5,发现页国内直连下载,功能与截图全介绍。
黑粉盒子已正式推出,从 1.0.0 开始正式迭代,提供 Mac、Windows、Linux 安装包。文中早期截图与探测数字保留为开发记录,不代表当前免费额度。
GLM-5.3-Flash、Qwen3.8 与 Coding GLM 免费接口复核:能不能用、怎么接、额度与隐私风险一次看清。
AgentPad13 把一台卖断货的 Codex Micro 拆成了可复用的方法:成品可以买空,公开设计却不会缺货。
Qwen4 架构预演开放权重:每个 token 激活 6B,但当前最小 GGUF 仍有 72.55GB。本文只按官方仓库、配置与文件清单分析,没有本机实测。
8 月 20 日深夜,OpenRouter 多了一行 stealth/ox-alpha。没有公司、没有仓库、没有名字,两天冲上调用量第一。104 万上下文、能看视频、完全免费——代价写在页面顶上。
harness 不是外壳是挽具;连 agent 循环都是插件,所以模型能换成本机的——附两份配置文件的实际写法与四处不写就翻车的字段。
能直接调用的免费接口、特色与限制