← 返回蜂巢洞察

演讲主题:SafeChat:如何在实时交易环境中大规模构建基于人工智能的安全系统

Bruna Pereira解释了DoorDash是如何构建这样一个能够处理各种类型内容的AI审核平台的。她介绍了如何用混合架构来取代那些仅依赖大语言模型的昂贵审核流程:利用快速的内部模型来过滤那些显而易见的错误,通过大语言模型进行多维度评估以做出更细致的判断,并使用无代码工作流程来进行后续测试。了解这种架构设计是如何在保障安全性的同时,使系统能够处理每天数百万条消息的。 作者:Bruna Pereira

Bruna Pereira解释了DoorDash是如何构建这样一个能够处理各种类型内容的AI审核平台的。她介绍了如何用混合架构来取代那些仅依赖大语言模型的昂贵审核流程:利用快速的内部模型来过滤那些显而易见的错误,通过大语言模型进行多维度评估以做出更细致的判断,并使用无代码工作流程来进行后续测试。了解这种架构设计是如何在保障安全性的同时,使系统能够处理每天数百万条消息的。

作者:Bruna Pereira

相关文章

技术实践

如何从大型语言模型中获取可靠的结构化数据

大多数关于如何调用语言模型的教程都会在 JSON.parse(response.content) 这行代码处结束。这段代码在处理前十个测试用例时确实可以有效运行。但当你开始实际应用时,会在第400次左右的一次请求中遇到问题:模型可能会返回一个它自己编造出来的日期,或者当你的数据结构应该包含5个元素时却返回8个数组项,又或者返回一个格式完全正确但实际上缺少某个字段的JSON对象。 我在开发Temploracraft这个简历工具时遇到了这样的问题。这个工具会接收用户上传的文档,并将其转换成应用程序可以编辑的结构化数据。 输入的数据确实具有很大的不可预测性:有些是两列结构的PDF文件,有些表格其实并

阅读全文
技术实践

从Mixtral到Kimi K3:专家混合模型是如何发展的

在本文中,我们将探讨混合专家模型是如何从最初仅有少数几个“专家”组件,发展到每层包含近900个“专家”组件的,以及那些使得这种稀疏架构仍能保持可训练性且成本可控的压缩机制与稳定性机制。 开放权重的混合专家模型发展速度惊人:Mixtral的总参数数量约为470亿,DeepSeek-V3达到了6710亿,而Kimi K3的参数数量更是突破了万亿大关。令人惊讶的是,并非这些模型的规模本身,而是每个模型实际上只使用极少量参数来处理每一个输入数据。 Kimi K3拥有2.8万亿个参数,但其中仅有约1040亿个参数被用于处理任何一个输入数据。在几乎每一层中,都有一个小型“路由器”从896个专门的前馈网络中

阅读全文
技术实践

演讲主题:从人工智能代理演示到实际应用:自动化测试与评估

周宇探讨了为什么人工智能代理在演示阶段会遇到停滞现象,并介绍了如何通过基于模拟的测试来解决合规性及可靠性方面存在的问题。了解哥伦比亚大学和Arklex AI是如何利用合成用户角色、轨迹熵以及自动化的持续集成/持续部署流程来评估多轮交互式智能代理的,从而在部署之前发现潜在问题,并在生产环境中优化这些自主学习工作流程的。 作者:周宇

阅读全文
技术实践

如何使用屏幕阅读器来使用 Discord:快速指南

Discord就是这样一种技术:几年前它突然出现,如今已经无处不在。 各种社区、项目和倡议都建立了大量的服务器,而且这类服务器还在不断涌现。在很大程度上,它们已经取代了论坛、聊天室,有时甚至也替代了文档网站和新闻板块的功能。 这种变化究竟是好是坏,还有待讨论,但可以肯定的是,Discord将会长期存在下去。 就可访问性而言,Discord曾经面临过一些问题。多年来,对于使用屏幕阅读器的用户来说,使用这款软件一直非常不便,因为开发者显然没有充分考虑过可访问性的需求。 不过在过去的几年里,这种情况已经得到了显著改善。虽然到2026年时,Discord仍然不是完全适合所有用户使用的工具,但只要掌握了

阅读全文