跳到主要内容

5 篇博文 含有标签「LLM」

Large language model related posts

查看所有标签

Ollama

· 阅读需 11 分钟

不是泛泛介绍 Ollama 是什么,而是专门测它的速度——在 Apple M1 Pro 上用 llama3.2:1b、qwen2.5:0.5b 跑出真实的 tokens/s 数据,同时梳理社区里"Ollama 比原生 llama.cpp 慢"的争议、和 vLLM/MLX 的对比,以及量化、上下文长度、GPU 开关这些影响速度的关键因素。

Kimi CLI

· 阅读需 11 分钟

Kimi CLI 是 Moonshot AI 做的终端 AI 编程 Agent,能读写代码、执行 Shell 命令并接入 MCP、ACP 编辑器协议,项目目前已被官方标注为逐步停止维护,建议新用户直接使用继任项目 Kimi Code CLI。