纯文本场景,真的需要 VLM 吗?
OpenViking 配置里硬要把模型叫"vlm"是个误导——它其实就是个 LLM 调用接口,只不过额外能接受图片输入。这篇拆开 VLM 跟 LLM 的真实关系(VLM ⊃ LLM),告诉你纯文本场景下完全可以用普通 LLM 替换,能省一大笔成本。
翻开此册
Of Memory & Mirrors
一款 agent 工具的多维深度审视 — 记忆 / 状态 / 资源 / 模型选型
OpenViking 配置里硬要把模型叫"vlm"是个误导——它其实就是个 LLM 调用接口,只不过额外能接受图片输入。这篇拆开 VLM 跟 LLM 的真实关系(VLM ⊃ LLM),告诉你纯文本场景下完全可以用普通 LLM 替换,能省一大笔成本。
字节火山引擎刚开源不久的 Agent 上下文数据库到底"新"在哪?OpenViking 把记忆 + 资源 + 技能塞进虚拟文件系统按 L0/L1/L2 三层加载;Claude Code 则极简到 CLAUDE.md + Auto Memory。一个是长期自治 Agent 的基础设施,一个是开发会话的状态延续——两套设计哲学的横向对比。
书架上放的是书还是书目卡片?OpenViking 跟传统搜索索引根本就不是一回事——它会把全部内容完整复制到 Server。这篇拆解一份资料从 Agent 进入 OpenViking 后被切成四样东西的全过程,以及由此带来的隐私边界问题和部署建议。
能不能在你的开发机上跑 OpenViking?大概要吃多少内存和磁盘?两种部署模式开销差出一个量级,得看你选哪条路。这篇横向对比 Linux / macOS / Windows 三平台的支持完整度,列出 Server / Client 两种模式的资源画像。
构建 Agent 系统绕不开的四个基础词:Server 是干活的、Client 是发号施令的;Embedding 是"语义指纹"、VLM 是"看图说话的 AI"。把它们各自干什么、为什么 OpenViking 两个 AI 模型都要——一次性讲透。