原
公众号

原力注入

原力注入受原力觉醒和依赖注入(Dependency injection)启发,希望通过本平台及我们的努力将云原生技术的原力注入给广大技术从业者。

441 篇已收录文章

这个来源的文章

按发布时间排序

从 H200 到 Blackwell 的飞跃:vLLM 助力 DeepSeek 吞吐量飙升 5 倍的五大技术内幕

在大语言模型生产部署中,DeepSeek-V3/R1 等 MoE 架构对算力、带宽与通信提出极高要求。vLLM 联合 Meta 与 NVIDIA,在 Blackwell(GB200)平台实现软硬件深度融合,带来代际性能跃升,不仅刷新性能基准,更提升推理经济性,并实现约 5 倍吞吐提升。

阅读全文 :从 H200 到 Blackwell 的飞跃:vLLM 助力 DeepSeek 吞吐量飙升 5 倍的五大技术内幕

只有耐得住寂寞,才能等来“太平年”——从程序员杨利辉的逆袭说起

在这个技术爆炸、人心浮躁的时代,最快的捷径依然是长期主义。无论你是程序员、设计师还是产品经理,只要你能耐得住寂寞,用专业能力在自己热爱的领域里深耕,终有一天,风口会来找你。

阅读全文 :只有耐得住寂寞,才能等来“太平年”——从程序员杨利辉的逆袭说起

NVIDIA Inference Context Memory Storage 之关键点:软件定义存储栈创新

在传统的 AI 推理架构中,KV Cache 的管理往往面临“重新计算”或“有损压缩”的权衡,且现有的存储 OEM 方案(如传统的可靠性与压缩服务)并不直接支持 KV Cache 的语义逻辑。NVIDIA推理上下文内存存储 (ICMS) 通过全新的软件定义存储栈,彻底改变了这一现状

阅读全文 :NVIDIA Inference Context Memory Storage 之关键点:软件定义存储栈创新

AI 原力注入恭祝大家马年大吉,阖家安康!

愿马年如骏马奔腾,步履坚定,志向高远; 事业策马扬鞭,蒸蒸日上;生活万事顺遂,平安喜乐。 愿奋进之力常伴左右,所行皆坦途,所愿皆可期。 AI 原力注入谨此致以诚挚祝福: 愿新的一年,智慧与创新同行,探索与突破并进, 在时代浪潮中乘势而上,共赴更广阔的未来。 恭祝新春愉快,马年大吉,阖家安康。

阅读全文 :AI 原力注入恭祝大家马年大吉,阖家安康!

从 Brendan Gregg 入职 OpenAI 看技术人的下一阶段职业方向

Brendan Gregg 入职 OpenAI,并不是系统工程师“转行 AI”,而是 系统工程在 AI 时代重新成为核心竞争力。AI 的下半场,不属于只懂模型的人,而属于真正理解系统的人。谁能在极端规模下,把算力、系统与工程效率做到极致,谁就站在下一轮技术浪潮的中心。

阅读全文 :从 Brendan Gregg 入职 OpenAI 看技术人的下一阶段职业方向

CacheBlend 技术详解:RAG 场景下的 KV Cache 动态融合机制与源码剖析

本文档深度剖析 LMCache 中 CacheBlend 技术的工程实现。本文结合源码详细解读如何利用“选择性重算与融合”机制,突破 RAG 场景下 Prefix Caching 的限制。该技术实现了非前缀 KV Cache 的高效复用,显著降低首字延迟 (TTFT) 并提升推理吞吐量。

阅读全文 :CacheBlend 技术详解:RAG 场景下的 KV Cache 动态融合机制与源码剖析

Software 3.0 时代:当 AI 成为你的"超级编译器",好书推荐:《驾驭 Gemini 3 与 Nano Banana:人人都是 AI 产品创客》

Software 3.0 时代,编程核心转向需求定义。AI 消灭语法门槛,让品味与工程思维成为新护城河。《驾驭 Gemini 3 与 Nano Banana》基于 Google 最新模型,通过 15 个全链路案例,教你掌握文档驱动开发,从零构建 AI 产品,是人人都能上手的实战指南。

阅读全文 :Software 3.0 时代:当 AI 成为你的"超级编译器",好书推荐:《驾驭 Gemini 3 与 Nano Banana:人人都是 AI 产品创客》

OpenSpec 实战指南:AI 辅助软件工程全流程深度复盘

本文以一个 小型电商系统 的从零构建到生产级演进为例,深度复盘基于 OpenSpec 的 AI 协同开发全流程。我们将展示 OpenSpec 如何作为“人机通用语言”,贯穿架构设计、系统实现、测试验证与迭代演进的每一个环节,确保 AI 生成的代码可控、可信、可维护。

阅读全文 :OpenSpec 实战指南:AI 辅助软件工程全流程深度复盘