一位技术开发者在Hacker News上发布了将35kb大规模预提示词从OpenAI/Anthropic等前沿LLM提供商迁移到自托管Ollama系统的技术笔记。在这一迁移过程中,他遇到了多项性能瓶颈。该35kb预提示词在128GB AMD Ryzen系统上立即消耗了总上下文窗口的14%。由于本地模型的上下文窗口限制…