行业资讯2026年8月17日Databricks 获 50 亿美元融资估值达 1900 亿美元 AI 基础设施需求激增Databricks 首席执行官 Ali Ghodsi 透露了公司为何在最初仅寻求 10 亿美元融资的情况下接受了 50 亿美元,凸显了生成式 AI 时代对资金的巨大需求。阅读全文 →
行业资讯2026年8月14日NVIDIA 的 5000 亿美元旧 GPU 融资计划分析英伟达正在制定一项宏大的金融框架,旨在保障其 AI 硬件的残值,从而为 AI 基础设施的持续借贷和建设提供保障。阅读全文 →
模型评测2026年8月12日优化推理模型:以更少的 Token 实现 ACE 级别的性能深入探讨如何减少 DeepSeek-R1 和 OpenAI o1 等推理模型在推理过程中的计算开销,在保持高质量输出的同时优化 Token 使用效率。阅读全文 →
行业资讯2026年7月24日AMD Helios AI 机柜级系统正式发布 挑战 Nvidia 市场地位AMD 推出全新的 Helios AI 机柜级系统,集成 MI325X 加速器与先进网络技术,旨在全面挑战 Nvidia 的 Blackwell 基础设施架构。阅读全文 →
行业资讯2026年7月21日Google 研发新型 AI 芯片以提升 Gemini 运行效率据报道,Alphabet 正在研发一种专门的 AI 芯片,旨在大幅降低运行 Gemini 模型的延迟和成本,这标志着 AI 基础设施领域的重大变革。阅读全文 →
行业资讯2026年7月19日弥合 AI 算力鸿沟:企业为何在无法衡量成本的情况下加速基础设施投入最新研究显示,企业在 AI 基础设施上的投入远超其衡量投资回报率(ROI)的能力。发现为何 64% 的组织计划更换供应商,以及如何优化您的 AI 技术栈。阅读全文 →
行业资讯2026年7月17日GPU 融资方转向推理芯片:4 亿美元交易揭示 AI 基础设施新趋势AI 基础设施领域正发生重大变革,一项 4 亿美元的芯片抵押贷款表明,投资重点正从以训练为中心的 GPU 转向专门的推理硬件。本文深度分析这一转型背后的经济与技术逻辑。阅读全文 →
模型评测2026年7月17日NVIDIA Nemotron 3 Embed 在 RTEB 基准测试中夺冠:推动智能体检索技术革新NVIDIA 的 Nemotron-3-8B-Embed 模型在检索型工具评估基准(RTEB)中荣登榜首,这标志着智能体 RAG(Agentic RAG)和工具调用效率迈入了新纪元。阅读全文 →
AI教程2026年7月11日告别 RAG:持久化神经状态与长文本大模型的未来检索增强生成 (RAG) 曾是大模型局限性的重要桥梁,但行业正转向持久化神经状态和海量上下文窗口。探索 AI 基础设施的下一次演进。阅读全文 →
模型评测2026年7月8日在 Foundry 托管计算平台上部署 Hugging Face 模型深入探讨 Hugging Face 与 Foundry 托管计算的集成方案,为开发者提供高性能 LLM 部署的技术路径、性能评估及成本优化策略。阅读全文 →
模型评测2026年7月8日使用 SkyPilot 和 Hugging Face 零出口存储在任意云端运行 AI 工作负载了解如何利用 SkyPilot 和 Hugging Face 在任何云提供商之间运行 AI 训练和推理,同时避免产生巨额的数据出站流量费用。阅读全文 →