← 返回蜂巢洞察

文章:代理适应度函数:将进化机制的应用范围扩展到确定性规则之外

确定性规则能够有效保障各项硬性指标的准确性,但建筑设计的初衷呢?了解如何利用“智能适应性评估函数”结合人工智能代理与分版本的评估标准,来评估那些需要主观判断的复杂问题——比如边界匹配度、语义契约的偏离情况,以及那些已经过时的假设等等。通过持续且经过校准的反馈机制,可以进一步提升进化式架构管理的效率。 作者:Hemant Kumar Mahato、Łukasz Sieczkowski、Vijayasenthilkumar Kuppusamy

确定性规则能够有效保障各项硬性指标的准确性,但建筑设计的初衷呢?了解如何利用“智能适应性评估函数”结合人工智能代理与分版本的评估标准,来评估那些需要主观判断的复杂问题——比如边界匹配度、语义契约的偏离情况,以及那些已经过时的假设等等。通过持续且经过校准的反馈机制,可以进一步提升进化式架构管理的效率。

作者:Hemant Kumar Mahato、Łukasz Sieczkowski、Vijayasenthilkumar Kuppusamy

相关文章

技术实践

人工智能评估工程:从零开始构建一款可用于生产环境的大型语言模型评估平台【完整使用手册】

一个令人印象深刻的演示与一个值得信赖的系统之间的差距,其实是通过各种评估来衡量的。 我想先讲一个目前正在数百个工程团队中发生的真实案例。 有一个团队为法律研究开发了一个RAG应用程序。他们用40个精心挑选的问题对该程序进行了测试,结果看起来很不错,于是便向合作方展示了这个系统。合作方对它印象深刻,随后便决定将其正式投入使用。 然而在系统投入生产三周后,一名法律助理发现其中一个答案错误地引用了某项法规。工程团队查看了相关数据,发现“准确性得分”为0.91,这个数值看起来是正常的;他们还检查了答案的相关性,结果也符合标准。 但他们忽略了一个重要的指标:即“上下文完整性”。这个指标用于判断系统是否检

阅读全文
技术实践

使用OpenTelemetry实现Claude Code的可观测性

像 Claude Code 、 OpenAI Codex 、 Google Antigravity 以及 Cursor 这样的代理编码工具,在日常软件开发中已经变得无处不在。 随着代理系统的不断发展,开发者让这些系统完成的大部分工作都是通过逐个分配子任务来实现的。许多团队也在探索并使用共享的、多租户式的代理基础设施,这种架构的成本不会与某个特定的所有者挂钩。在这种情况下,可观测性就成为了监控基础设施成本的关键因素。 在本指南中,您将了解可观测性的工作原理,然后学习如何启用Claude Code内置的遥测功能,运行后端程序来收集数据,并读取该系统生成的各类指标、日志及追踪信息。这些内容将帮助您更

阅读全文
技术实践

如何在Flutter开发中运用各种技能:开发者手册

关于人工智能辅助开发,最大的误解之一就是认为使用人工智能就意味着要放弃多年来积累的工程经验。其实并非如此。 你可以将自己所学到的架构模式、犯过的错误、团队遵循的规范,以及作为Flutter工程师所制定的标准,通过特定的技能教给人工智能编码助手。这样一来,你就不必在自身经验与人工智能之间做出选择,而是可以将两者结合起来使用。 然而,几乎每一位Flutter开发者,在第一次在实际项目中使用人工智能编码助手时,都会遇到一些令人沮丧的情况。 比如,当你让助手生成一个个人资料页面时,它虽然能生成能够正常运行的代码,但却没有在`widgets/`文件夹中创建一个结构清晰、可重复使用的`ProfileCar

阅读全文
技术实践

文章:利用工作负载身份联合机制在GCP中消除长期有效有效的凭证

长期使用的GCP服务账户密钥属于必须永久管理的机密信息,这些密钥难以定期更替,同时也很容易被泄露。将“工作负载身份联合机制”应用于120多个生产项目后,人们才意识到这种机制彻底改变了机器身份管理的方式:密钥仍然需要被妥善管理,但联合身份机制所代表的则是那些只需配置一次的信任关系,而这些信任关系的应用则取决于特定的属性条件。 作者:Shijin Nair

阅读全文