<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>AIEII</title><link>https://aieii.com/tags/%E6%9C%AC%E5%9C%B0%E9%83%A8%E7%BD%B2/</link><description>来自 AIEII 传播部门的最新通讯</description><generator>Hugo -- gohugo.io</generator><language>zh-CN</language><lastBuildDate>Mon, 10 Aug 2026 11:10:24 +0800</lastBuildDate><atom:link href="https://aieii.com/tags/%E6%9C%AC%E5%9C%B0%E9%83%A8%E7%BD%B2/index.xml" rel="self" type="application/rss+xml"/><item><title>本地跑 Kimi-K2.6 与 GLM-5.2：Ollama 完整部署与选型实操指南</title><link>https://aieii.com/posts/2026-08-10-ollama-local-kimi-glm-guide/</link><pubDate>Mon, 10 Aug 2026 17:00:00 +0800</pubDate><guid>https://aieii.com/posts/2026-08-10-ollama-local-kimi-glm-guide/</guid><description>&lt;p&gt;你八成也犯过这个错。装好 Ollama，拉下一个模型，一跑发现回答到一半就断了，或者长文档喂进去它前面说的话全忘了。查了半天代码逻辑，最后发现问题就一个：Ollama 默认上下文长度是 4096 token。不到 4K，一份长一点的技术文档还没读完就被截断了。&lt;/p&gt;</description></item></channel></rss>