← 返回蜂巢洞察

演讲主题:如何自动对JIT编译器进行改造升级

Laurence Tratt介绍了yk这一开源的元追踪JIT编译器框架。他讲解了如何通过进行最小限度且不会对代码造成实质性影响的修改,来自动提升Lua、MicroPython这类基于C语言编写的解释器的运行速度。他还详细阐释了追踪机制的工作原理,以及如何利用开发人员提供的提示来优化编译后的代码执行路径,同时介绍了如何处理那些需要恢复到原始解释器执行方式的复杂情况。 作者:Laurence Tratt

Laurence Tratt介绍了yk这一开源的元追踪JIT编译器框架。他讲解了如何通过进行最小限度且不会对代码造成实质性影响的修改,来自动提升Lua、MicroPython这类基于C语言编写的解释器的运行速度。他还详细阐释了追踪机制的工作原理,以及如何利用开发人员提供的提示来优化编译后的代码执行路径,同时介绍了如何处理那些需要恢复到原始解释器执行方式的复杂情况。

作者:Laurence Tratt

相关文章

技术实践

Java新闻汇总:Shenandoah垃圾回收器、TeamCity中的安全漏洞、A2A Java开发工具包、Camel框架、Gradle构建工具、GlassFish服务器以及Groovy语言

本周于2026年8月3日发布的Java新闻汇总中,重点介绍了以下内容:JEP 535项目——Shenandoah垃圾收集器默认采用分代回收模式,该功能将应用于JDK 28版本;A2A Java SDK、Apache Camel以及Gradle都发布了更新版本;GlassFish也进行了维护性升级;Groovy 8.0也迎来了第五个里程碑版本的发布;同时,JetBrains的TeamCity也针对安全漏洞进行了相应的修复。 作者:Michael Redlich

阅读全文
技术实践

大规模产品实验:Airbnb、Netflix、Lyft和Uber是如何针对基于大语言模型的AI功能进行因果分析的

对于基于大语言模型的AI功能而言,因果推断已不再是理论上的概念。Airbnb、Netflix、Lyft和Uber都发布了详细的工程博客文章,详细说明了他们是如何衡量产品变更对用户行为的因果影响的。 他们所使用的技术方法(如差异分析法、回归不连续性分析以及双重稳健估计等)都是标准工具。 值得关注的是,这些团队是如何在大规模应用中运用这些技术的:在哪些情况下这些方法在实际操作中会失效,他们又是如何通过补充措施来确保估算结果的可靠性,以及他们是如何将这些数据与实际的产品决策联系起来的。 如果你正在开发基于大语言模型的功能,并且是根据用户点赞率和会话时长来做出产品决策的,那么这些文章一定会改变你对测量

阅读全文
技术实践

人工智能评估工程:从零开始构建一款可用于生产环境的大型语言模型评估平台【完整使用手册】

一个令人印象深刻的演示与一个值得信赖的系统之间的差距,其实是通过各种评估来衡量的。 我想先讲一个目前正在数百个工程团队中发生的真实案例。 有一个团队为法律研究开发了一个RAG应用程序。他们用40个精心挑选的问题对该程序进行了测试,结果看起来很不错,于是便向合作方展示了这个系统。合作方对它印象深刻,随后便决定将其正式投入使用。 然而在系统投入生产三周后,一名法律助理发现其中一个答案错误地引用了某项法规。工程团队查看了相关数据,发现“准确性得分”为0.91,这个数值看起来是正常的;他们还检查了答案的相关性,结果也符合标准。 但他们忽略了一个重要的指标:即“上下文完整性”。这个指标用于判断系统是否检

阅读全文
技术实践

在大型语言模型应用中,当你的两个模型都出现错误时,如何通过双重鲁棒性估计方法来进行产品测试与优化?

六个月前,你们推出的这款人工智能产品开始采用“用户主动选择参与”的模式。你们进行了倾向性分析,并考虑了用户的参与程度以及查询的准确性等因素,最终发现任务完成率确实提高了8个百分点。这一数据被纳入了季度业务报告中,大家都对此感到满意。 然而,严谨的数据科学家难免会提出一些棘手的问题:你们有多确定这个倾向性模型已经考虑到了所有可能影响结果的因素?如果遗漏了某些因素,那么逻辑回归模型得出的选择概率就会不准确;又或者,如果结果回归模型的设定本身就有误——因为任务完成率与查询准确性之间的关系并非线性的,线性模型根本无法准确反映这一关系——那又会怎样呢? 你们有两个模型,但并不确定哪个是正确的,而这两个模

阅读全文