DoorDash利用多智能体大语言模型来处理这60,000个功能标志相关的数据。
DoorDash构建了一个多智能体大型语言模型系统,用于自动化清理超过60,000个特征标志以及分布在623个代码仓库中的这些标志。该工作流程结合了实时实验数据、工程师的审核流程、独立的Git开发环境、并行运行的智能体以及自动验证机制。在针对50个特征标志进行的测试中,有45个特征标志在平均13.8分钟的时间内生成了可使用的拉取请求,每次清理操作的成本为4.79美元。 作者:Leela Kumili

DoorDash构建了一个多智能体大型语言模型系统,用于自动化清理超过60,000个特征标志以及分布在623个代码仓库中的这些标志。该工作流程结合了实时实验数据、工程师的审核流程、独立的Git开发环境、并行运行的智能体以及自动验证机制。在针对50个特征标志进行的测试中,有45个特征标志在平均13.8分钟的时间内生成了可使用的拉取请求,每次清理操作的成本为4.79美元。
作者:Leela Kumili相关文章
Swiggy利用350多项功能以及多任务神经网络模型来预测客户的终身价值。
Swiggy开发了一套自主研发的预测生命周期价值模型,该模型采用了超过350个预订单相关特征,并结合了多任务MLP算法来分析Food业务及Instamart业务的数据。通过将订单数量作为辅助训练指标,模型的参数数量减少了63%,同时其预测性能也得到了提升。目前,Swiggy正在将这种预测生命周期价值的方法与Google的Target ROAS竞价系统相结合,以优化客户获取策略。 作者:Leela Kumili
阅读全文
演讲主题:SafeChat:如何在实时交易环境中大规模构建基于人工智能的安全系统
Bruna Pereira解释了DoorDash是如何构建这样一个能够处理各种类型内容的AI审核平台的。她介绍了如何用混合架构来取代那些仅依赖大语言模型的昂贵审核流程:利用快速的内部模型来过滤那些显而易见的错误,通过大语言模型进行多维度评估以做出更细致的判断,并使用无代码工作流程来进行后续测试。了解这种架构设计是如何在保障安全性的同时,使系统能够处理每天数百万条消息的。 作者:Bruna Pereira
阅读全文
WhatsApp正在测试利用设备上的机器学习技术来进行诈骗检测,并同时采用能够保护用户隐私的分析方法。
WhatsApp正在有限范围内进行Scam Alert功能的测试。该功能利用设备上的机器学习技术,来识别来自非联系人的潜在诈骗信息。Meta的架构能够将消息内容保留在用户设备上;同时,通过使用保密计算、不可察觉的HTTP传输方式、差分隐私技术以及模型透明度机制,来评估这一功能的性能并确保模型数据的安全传输。 作者:Leela Kumili
阅读全文
OpenAI推出了分类评估框架及相关案例研究,用于分析模型表现与预期目标之间的偏差。
OpenAI发布了一套用于识别模型在其生命周期中出现的偏差的披露框架。员工可以报告潜在的问题,这样技术人员就能对这些问题进行分类处理。最初的案例研究揭示了模型的一些异常行为,这些现象有助于我们了解模型参数与预期值之间的差异。公众对这一透明性举措的反应既有赞同,也存有疑虑。 作者:Olimpiu Pop
阅读全文