我在Mac mini使用OpenClaw接上本地Gemma4后，确认了一件事：AI成本正在归零

优质文章学习记录

10 Apr 2026 — 3 min read

Google 全新发布的 Gemma4 堪称 2026 年本地 AI 最优解，260 亿参数开源免费，普通笔记本就能离线全速运行。

今天我在折腾一件事：

👉 用 Mac mini 跑 Gemma 4 + 接入 OpenClaw

跑通之后，我的第一反应不是“AI更强了”，而是：

AI 的使用成本，正在被打到接近 0。

一、我是在 Mac mini 上跑起来的 Gemma 4

先说结论：

👉 Gemma 4 是可以在 Mac mini 上跑的

我用的是轻量版本（E4B），本地直接跑，完全离线。

没有云，没有API，没有费用。

两分钟搞定：

12 curl -fsSL ollama.com/install.sh | sh ollama pull gemma4:e4b

跑起来之后，你会有一种感觉：

AI第一次真正属于你自己的硬件了

二、Gemma 4 发布，我把架构扒了一遍

我专门对比了 Gemma 4 和 Gemma 3。

结论很有意思👇

✅ 架构几乎没变

还是那一套：

• Pre/Post-norm
• 5:1 hybrid attention
• GQA

说白了：

👉 不是靠架构创新赢的

✅ 但性能直接起飞

• 基准测试全面超 Gemma 3

✅ 26B MoE 是最大惊喜

👉 总参数 26B
👉 实际激活只有 4B

什么意思？

用小模型的成本，打大模型的效果

✅ 最关键：Apache 2.0

这一点很多人没意识到有多重要：

👉 可以商用
👉 可以改
👉 可以私有部署

一句话总结 Gemma 4

架构没变，数据和训练方法才是真王道

所以我现在的判断是：

👉 架构党可以先歇歇了

三、很多人没看懂 Gemma 4 真正的价值

大部分人看到的是：

👉 开源
👉 免费
👉 本地能跑

但这些都不是重点。

真正的重点只有一个：

它原生支持 Function Calling（函数调用）

这意味着什么？

👉 它可以自己调用工具
👉 可以执行代码
👉 可以访问API
👉 可以连数据库
👉 可以浏览网页

说白了：

它不是聊天模型，是一个“能干活的本地智能体”

四、为什么我一定要接 OpenClaw

因为：

👉 Gemma4 + OpenClaw = 本地AI系统

OpenClaw 是什么？

你可以理解为：

AI的操作系统（Agent OS）

它负责：

• 多Agent协作
• 任务执行
• 工具调用（MCP）
• 长时间运行

但很多人卡在这里：

👉 OpenClaw 根本没用到你的大模型

比如你看到：

1 gateway-injected

那说明：

你还在用内置小模型

五、正确接入姿势（关键）

1️⃣ 拉对模型

123 ollama pull gemma4:26b # 或 ollama pull gemma4:31b

⚠️ 不能写 gemma4
必须写完整：gemma4:26b

2️⃣ 配置 OpenClaw

123456 {   "id": "gemma4:26b",   "name": "Gemma4 Local",   "contextWindow": 262144,   "maxTokens": 8192 }

3️⃣ 强制切换模型

1 /model ollama/gemma4:26b

当你看到：

1 agent main | ollama/gemma4:26b

那一刻开始：

你就拥有了一个真正的本地 AI Agent

六、今天的测试

🧠 本地：Gemma 4

负责：

• 写文章
• 代码审查
• 数据处理
• 日常分析

🔧 工具：MCP + OpenClaw

负责：

• 调接口
• 浏览网页
• 数据库操作
• 自动执行任务

☁️ 云端：Claude Code（备用）

只在以下情况用：

• 高复杂推理
• 架构设计
• 超大项目

七、这套组合带来的变化（非常关键）

以前：

👉 每个月 AI 成本几百美金

现在：

👉 90% 本地解决
👉 只为 10% 付费

一句话总结：

AI从“按token收费”，变成“按电费收费”

八、我有一个老设备也能跑

我现在甚至在试：

👉 老显卡 + gemma4:e4b

结果是：

👉 轻松跑
👉 稳定
👉 可用

随便用，只耗电

2026全球最强十大AI大模型

1. GPT-5.2 定位：深度推理之王。优势： * 极致推理：在数学、物理、逻辑谜题及复杂代码架构设计上仍保持全球第一，尤其是其“Thinking”模式，能处理极度复杂的链式推理任务。缺点： * 成本高昂：API调用价格昂贵，不适合大规模低成本应用。 2.Gemini 3 Pro (Google) 定位：原生多模态霸主，长上下文王者。优势： * 超长上下文：支持数百万Token的上下文窗口，能一次性处理整本书、长达数小时的视频或大型代码库。 * 多模态融合：真正的“原生”多模态，对图像、音频、视频的理解能力远超其他模型，能直接分析视频中的细微动作和语音语调。 * 谷歌生态：与Google Workspace、Search深度集成，实时信息检索能力极强。缺点： * 幻觉问题：在处理极度冷门的知识时，偶尔会出现“自信地胡说八道”的情况。

OpenClaw（龙虾）智能体框架深度剖析：普通用户是否应拥抱这场AI浪潮？

OpenClaw智能体框架深度剖析：普通用户是否应拥抱这场AI浪潮？引言：OpenClaw的前世今生 2025年底，奥地利资深软件架构师Peter Steinberger在GitHub上发布了一个名为OpenClaw的开源项目，旨在构建一个能够自主操作计算机的AI智能体框架。该项目因其Logo形似红色小龙虾，被中文互联网社区昵称为“龙虾”。短短数月内，其GitHub星标数突破百万，超过Linux内核，成为全球开发者社区的现象级产品。 OpenClaw的本质是一个“AI代理”框架：它通过调用大语言模型（如GPT、Claude等）的API，获得理解与决策能力，并借助系统级权限直接操作电脑上的各类应用——从文件管理、邮件收发，到浏览器控制、机械臂驱动，几乎无所不能。用户只需以自然语言下达指令，OpenClaw便能自主规划、执行任务，并将结果反馈。 2026年1月起，OpenClaw的热潮迅速席卷国内。北上广深等一线城市涌现大量“安装服务”，互联网大厂纷纷推出基于OpenClaw的定制化产品，地方政府甚至出台政策扶持相关产业发展。然而，与狂热相伴而生的是首批用户的“卸载潮”——有人

Vibe Coding范式实战：用AI工具链（Stitch+Figma+ai studio+Trae）快速开发全栈APP

文章目录 * 概要 * stitch制作设计稿 * figma 原型展示 * ai studio 生成前端代码 * 基于trae + Supabase生成后端代码和数据库 * Github + vercel * pc端后台管理系统设计概要在 AI 技术深度渗透软件开发领域的当下，一种名为 “Vibe Coding”（氛围编程）的全新范式正在重塑开发者的工作方式。它的核心在于，开发者不再是逐行编写代码的 “码农”，而是通过自然语言描述意图、引导 AI 生成代码的 “创意引导者” 和 “结果验证者”，从而将精力聚焦于更高价值的产品设计和逻辑思考上。本文提供一种 Vibe Coding 的工作模式：设计阶段以 Google Stitch 为起点，开发者通过文本或草图快速生成响应式 UI 设计与前端代码，再无缝导入 Figma 进行精细化视觉调整和原型设计，实现了从 “想法” 到

LLM+RAG：AI生成测试用例智能体平台「详细介绍」

LLM+RAG：AI生成测试用例智能体平台 * 1. 系统概述 * 主要功能 * 2. 安装与配置 * 系统要求 * 安装步骤 * 3. 界面介绍 * 3.1 生成测试用例 (📝) * 3.2 知识库管理 (📚) * 3.3 模型设置 (⚙️) * 4. 生成测试用例 * 4.1 输入需求描述 * 4.2 配置生成参数 * 4.3 生成测试用例 * 4.4 查看生成结果 * 5. 知识库管理 * 5.1 上传知识文档 * 5.2 查看知识库内容 * 6. 模型设置 * 6.1 选择模型提供商 * 6.2