AI教程2026年6月23日在 Modal 上部署 GLM-5.2-FP8 (700B MoE):8x H200 无服务器架构、权衡与实战经验深入探讨如何使用 8x NVIDIA H200 GPU 集群部署智谱 AI 最新的 700B 参数 MoE 模型,涵盖 FP8 量化、vLLM 优化及无服务器冷启动调优。阅读全文 →
AI教程2026年6月20日GLM-5.2 发布:具备 1M 上下文的 MIT 开源编码智能体模型Z.ai 正式发布 GLM-5.2,这是一款采用 MIT 协议开源、支持 100 万超长上下文的旗舰级大模型,专为编码智能体(Coding Agents)和长程任务优化。阅读全文 →
模型评测2026年6月18日GLM-5.2 可能是目前最强大的纯文本开源权重 LLM深入分析智谱 AI 发布的 GLM-5.2 模型,探讨其技术架构、与 Llama 3.1 和 DeepSeek-V3 的性能对比,以及为何纯文本专注度使其成为开发者的首选。阅读全文 →
AI教程2026年6月15日本地运行 GLM-5.2:不受限制的开源大模型完全指南本文详细介绍了如何在本地部署智谱 AI 推出的 GLM-5.2 模型。涵盖硬件需求、2-bit 量化方案以及使用 llama.cpp、Ollama 和 LM Studio 的具体步骤。了解开源权重模型如何成为应对云端 API 停服风险的终极保险。阅读全文 →