文章:JDK 24之后的虚拟线程:在生产环境中的Java开发中发生了哪些变化
JDK 24去掉了那些在Java 21版本中导致Netflix等团队遇到开发瓶颈的、与监视器相关的机制。而在JDK 25 LTS版本中,这种问题被“下游资源饱和”这一新的瓶颈所取代:开发瓶颈的位置发生了变化,现在应用程序代码中必须明确设置相应的限制条件。本文分析了在采用虚拟线程技术后可能出现的各种故障情况,并提供了一套基于公开测试基准的实际解决方案。 作者:Sandeep Bharadwaj

JDK 24去掉了那些在Java 21版本中导致Netflix等团队遇到开发瓶颈的、与监视器相关的机制。而在JDK 25 LTS版本中,这种问题被“下游资源饱和”这一新的瓶颈所取代:开发瓶颈的位置发生了变化,现在应用程序代码中必须明确设置相应的限制条件。本文分析了在采用虚拟线程技术后可能出现的各种故障情况,并提供了一套基于公开测试基准的实际解决方案。
作者:Sandeep Bharadwaj相关文章
演示主题:如何通过一份数据同时完成从S3存储系统到GPU的计算任务——重新思考用于机器学习训练的数据加载方式
Onur Satici详细解释了如何利用Vortex这一由Linux基金会推出的开源列式文件格式来彻底改变高吞吐量数据加载的方式。他说明了如何通过层叠式的轻量级编码技术、基于文件结构的数据分段优化机制以及零拷贝内存传输技术,消除CPU与NVMe之间的性能瓶颈,从而让S3存储中的数据能够以高达60 Gbps的速度直接传输到GPU上,而无需在进行任何预处理操作。 作者:Onur Satici
阅读全文
演讲主题:从数千种选择到唯一答案:利用大语言模型构建高效的筛选系统
Jendrik Jördening分享了将大语言模型集成到生产流程中的实际工程策略。他探讨了如何克服不确定性问题、如何对数据结构进行限制、如何将语义文本提取与确定性代码分离,以及如何利用鉴别模型来验证各种设计决策。此外,他还介绍了如何采用MVC架构来组织大语言模型的开发工作,从而确保数据库的完整性、系统的可观测性以及其可靠性。 作者:Jendrik Jördening
阅读全文
Cloudflare推出了用于实现源站后缓存控制的缓存响应规则
Cloudflare最近推出了“缓存响应规则”这一功能——这种规则引擎会在源服务器做出响应之后、但在内容被写入Cloudflare的缓存系统之前开始发挥作用。此前,缓存规则仅能针对请求的相关属性进行操作;而“缓存响应规则”则增加了在内容被缓存之前对其响应内容进行评估的环节。 作者:雷纳托·洛西奥
阅读全文
Meta开源的Muse项目:一款专为设备端执行而优化的、规模高达300亿个参数的局部智能模型
Meta AI Research推出了Muse Glimmer这一模型。该模型是一个拥有300亿个参数的开放源代码模型,采用Apache 2.0许可证进行发布,专为本地计算环境设计。它能够让自主智能体在消费者级别的GPU上独立执行复杂任务,而无需依赖云服务API。Muse Glimmer采用了多阶段训练机制来提升性能,并且支持多种输入形式,从而有效辅助编码与自动化相关工作。 作者:Olimpiu Pop
阅读全文