AI教程2026年7月28日Kimi K3 开源权重与 18 美元对 60 美元的 API 价格战月之暗面(Moonshot AI)发布了 2.8 万亿参数的开源模型 Kimi K3。凭借其在前端开发和写作领域的顶尖表现,以及仅为 Claude Fable 5 三分之一的价格,Kimi K3 正式引发了全球 LLM 市场的价格革命。阅读全文 →
行业资讯2026年7月28日NVIDIA 与微软发起开源 AI 安全联盟:绕过 OpenAI 与 Google 的战略布局NVIDIA 与微软联手 IBM、SpaceX 等巨头成立“开源安全 AI 联盟”(Open Secure AI Alliance),旨在通过开源工具解决前沿大模型带来的安全风险,此前 OpenAI 模型的“失控”事件成为该联盟成立的直接导火索。阅读全文 →
AI教程2026年7月17日Moonshot AI 发布 Kimi K3:2.8 万亿参数开源模型,重塑代码生成与芯片设计月之暗面(Moonshot AI)正式发布 Kimi K3,这是一个拥有 2.8 万亿参数的混合专家模型(MoE),在 WebDev 榜单登顶,并展示了自主设计芯片和编写编译器的惊人能力。阅读全文 →
AI教程2026年7月6日Cohere Aya 23 深度解析:多语言开源模型的新标杆深入探讨 Cohere 发布的 Aya 23 系列模型。本文将分析其 8B 与 35B 参数版本的技术架构、多语言性能优势以及在企业级 RAG 场景中的实际应用,为开发者提供详尽的部署指南。阅读全文 →
AI教程2026年6月27日从本地 LLM 到工具调用智能体:使用 Gemma 2、Ollama 和 OpenAI Agents SDK 构建研究助手本教程详细介绍了如何将 Google Gemma 2 等本地模型转化为具备联网搜索能力的自主智能体(Agent),涵盖 Ollama 配置、OpenAI SDK 集成以及 Tavily 搜索工具的应用。阅读全文 →
AI教程2026年6月20日GLM-5.2 发布:具备 1M 上下文的 MIT 开源编码智能体模型Z.ai 正式发布 GLM-5.2,这是一款采用 MIT 协议开源、支持 100 万超长上下文的旗舰级大模型,专为编码智能体(Coding Agents)和长程任务优化。阅读全文 →
模型评测2026年6月18日评估开源大模型在自定义工具调用中的 Agent 能力深入探讨如何利用自定义工具集和严格的基准测试框架,评估 DeepSeek-V3 和 Llama 3.1 等开源模型在 AI Agent 场景下的表现。阅读全文 →
模型评测2026年6月18日GLM-5.2 可能是目前最强大的纯文本开源权重 LLM深入分析智谱 AI 发布的 GLM-5.2 模型,探讨其技术架构、与 Llama 3.1 和 DeepSeek-V3 的性能对比,以及为何纯文本专注度使其成为开发者的首选。阅读全文 →
AI教程2026年6月15日本地运行 GLM-5.2:不受限制的开源大模型完全指南本文详细介绍了如何在本地部署智谱 AI 推出的 GLM-5.2 模型。涵盖硬件需求、2-bit 量化方案以及使用 llama.cpp、Ollama 和 LM Studio 的具体步骤。了解开源权重模型如何成为应对云端 API 停服风险的终极保险。阅读全文 →
模型评测2026年6月1日NVIDIA Cosmos 3 物理 AI 推理与行动的开源全能模型深度解析 NVIDIA Cosmos 3:全球首个面向物理 AI 的开源全能模型。本文探讨其架构、物理推理能力以及如何改变机器人与自动驾驶行业。阅读全文 →
模型评测2026年5月15日Granite Embedding Multilingual R2: 具备 32K 上下文的 Apache 2.0 开源多语言嵌入模型IBM 发布了 Granite Embedding Multilingual R2,这是一款高性能、参数量低于 100M 的嵌入模型,支持 32K 上下文并采用 Apache 2.0 协议,为开源 RAG 树立了新标杆。阅读全文 →
AI教程2026年4月17日使用开源模型构建低成本生产级 AI 智能体指南本教程详细介绍了如何利用 OpenRouter、LangChain 以及 DeepSeek-V3 和 Llama 3 等开源模型,以每月不到 5 美元的成本构建高性能、生产级的 AI Agent。阅读全文 →