Zalando是如何构建出一个能够每秒处理一百万次请求的、运行在客户端端的负载均衡系统的
Zalando的工程团队最近介绍了他们为那种每秒需要处理约100万次请求的高吞吐量API所开发的、运行在客户端进程中的负载均衡系统的设计与实现方案。这一方案的实施使得延迟时间更加容易预测,基础设施的成本也有所降低,同时人们也能更清楚地了解故障实际上是从哪里发生的。 作者:Renato Losio

Zalando的工程团队最近介绍了他们为那种每秒需要处理约100万次请求的高吞吐量API所开发的、运行在客户端进程中的负载均衡系统的设计与实现方案。这一方案的实施使得延迟时间更加容易预测,基础设施的成本也有所降低,同时人们也能更清楚地了解故障实际上是从哪里发生的。
作者:Renato Losio相关文章
Stripe利用图搜索和状态机技术来实现数据库问题的自动化修复。
Stripe的工程团队最近介绍了他们是如何通过将全球基础设施建模为图结构来实现数据库故障恢复自动化处理的。该团队利用图搜索算法以及状态机,自动计算并执行相应的修复方案。 作者:Renato Losio
阅读全文
演讲主题:通过逐步将Rust语言集成到现有代码库中来提升性能
莉莉·玛拉介绍了如何通过渐进式的FFI重构来避免高风险的软件重写。她说明了工程团队如何利用PyO3将Python代码中的性能瓶颈替换为Rust代码,从而实现函数执行速度的显著提升、无缝的集成测试,并在无需引入微服务架构的情况下大幅降低基础设施维护成本。 作者:莉莉·玛拉
阅读全文
人工智能芯片是如何制造的
我们刚刚在freeCodeCamp.org的YouTube频道上发布了一门关于半导体供应链的全面课程,这门课程完全基于第一性原理进行讲解。该课程由硬件专家Kian Kyars主讲,深入剖析了从原始硅材料到最终在现代数据中心得到应用的整个过程。 随着用于人工智能基础设施的资本支出不断增加,达到数千亿美元之多,硬件已经不再是一个仅限于芯片设计专家研究的领域。对于开发人员、研究人员以及科技行业的专业人士来说,了解支撑现代人工智能模型运行的各种硬件设备已经变得至关重要。 这门课程重点介绍了Nvidia最新的硬件产品,详细讲解了双芯片结构的GB300 Blackwell Ultra GPU是如何进行设计
阅读全文
Shopify推出了Gisting技术:将大语言模型生成的提示语句压缩成特定的标记格式。
Shopify的工程团队采用了一种名为“gisting”的新技术,这种技术能够将冗长的大语言模型输入文本压缩成一组简短的、“精华提取后的”符号,从而提高处理效率并降低推理成本。 作者:Sergio De Simone
阅读全文