黑粉科技 · 全部文章

返回首页

第 2 / 4 页 · 每页 21 篇。 精彩依旧继续,我们等待着您。

1.4GB小模型,真能当本地智能体吗?

MiniCPM5-2B 把 13 万上下文、Agent 训练和官方 GGUF/MLX 一起塞进 2.52B 参数;真正的看点不是越级跑分,而是它有没有资格成为本地软件里的常驻执行器。

只开localhost,本地AI就安全吗?

只监听 127.0.0.1,不代表浏览器里的网页碰不到它。三个近期官方安全公告,加一组完全隔离的 CORS 实测,拆开本地 AI 最容易被误解的安全边界。

都说比 Ollama 快,可没人真跟 Ollama 比过

Ollama 半年前就把 Mac 推理换成了 MLX 内核,现在冒出一堆自称更快的挑战者。我没跑实测,只把四家自己公布的跑分摆到一张桌子上——结果是:谁也没跟谁跑同一套题。

GPT-6来了,它真开始替你干活了?

GPT-6 Astra 的真正变化,不是聊天分数再涨一点,而是电脑操作、长任务和高风险能力同时进入产品。本文按 OpenAI 官方资料拆解可用范围、API 成本、安全边界和普通人的选型方法。

8 GB 显存也能跑本地 AI:Windows 与 Mac 怎么选?

不讨论“软件有没有 Windows 版”这种表面问题,而是回答两件实际的事:8 GB NVIDIA 显卡能把哪些本地模型和工具跑起来,Mac 的统一内存与完整多媒体链又强在哪里。

免费 API 不用挨个试:Windows 与 Mac 自动换模型

把分散的免费 API 变成一个本地入口:先看官方证据,再用自己的 Key 真测路由,最后让 Cursor、Cline 和 OpenCode 自动换到还能用的模型。Windows 与 Mac 已可用,平台差异也写清楚。

谷歌憋了个网络安全大模型,却只给一小撮人用

9 月 2 日谷歌一口气发了 3.8 Flash 和 3.8 Flash Cyber。同一个核心,两副面孔:一个便宜好用人人能上,一个专治漏洞却只给可信防御方。有意思的不是谁更强,是这条分界线画在哪。

DeepSeek视觉开源,64GB Mac能跑吗?

DeepSeek把视觉变成Agent的感知入口,并开放305B权重。最新最小视觉GGUF仍约67.8GiB:64GB Mac今天不适合稳定部署。本文按官方资料与文件实算,不做本机运行冒充。

Fable 5.1没降价,为何还能省45%?

Fable 5.1 与 Mythos 5.1 是同一个底层模型,却被拆成大众版和可信访问版。基础单价没降,缓存读取却便宜75%;真正改变的是长时程Agent的任务经济性、安全边界与接入方式。

LocalBrain:把 Mac 变成私有 AI 盒子

我把 Mac 上分散的本地模型、转写、生图、视频、文档和 MCP,收进一个能下载、启停、对话、交付文件,还能自己清理缓存的本地工作台。1.4.8 新增第二个本地视频引擎 LTX-2.5,发现页国内直连下载,功能与截图全介绍。

Qwen4预演开源:最小量化仍装不下

Qwen4 架构预演开放权重:每个 token 激活 6B,但当前最小 GGUF 仍有 72.55GB。本文只按官方仓库、配置与文件清单分析,没有本机实测。

神秘模型爆了!牛来?

8 月 20 日深夜,OpenRouter 多了一行 stealth/ox-alpha。没有公司、没有仓库、没有名字,两天冲上调用量第一。104 万上下文、能看视频、完全免费——代价写在页面顶上。