观点2026年3月23日4 分钟阅读
人工智能代理的应用层:为什么基于画布的设计是未来
基础设施提供商处理实时音频。模型提供者负责推理。应用程序层——您设计、部署和监控代理的地方——是缺失的部分。这就是基于画布的平台所解决的问题。
AI 代理堆栈具有三层。基础设施:实时音频/视频传输、电话、WebRTC(这是 LiveKit、Twilio 和类似提供商解决的问题)。模型:LLM、ASR、TTS、视觉模型(这是 OpenAI、Anthropic、Google 和开源社区解决的问题)。还有应用程序层:您实际设计代理的行为,将其连接到您的业务系统,将其部署给客户,并监视所发生的情况。第三层明显不发达。
基础设施和经验之间的差距
您可以使用基础设施 SDK 启动实时音频会话。您可以调用模型API。您无法轻松做到的事情:使用条件逻辑设计多步骤对话,将其连接到 CRM 和日历,添加合规性护栏,将其部署在电话号码上,监控 10,000 个呼叫的性能,并根据分析迭代流程。这就是应用程序层——基础设施和用户体验之间的层。
为什么基于画布的设计会获胜
基于代码的代理框架为工程师提供了最大的灵活性,但其他人的可见性为零。仅提示平台允许非技术团队访问,但会牺牲可靠性和控制力。 Agent Canvas 等基于 Canvas 的平台占据了中间位置:足够直观,可供产品团队理解和修改;足够结构化,便于合规审计;强大到足以让工程人员通过自定义操作和集成进行扩展。
超越声音:所有形式的画布
如今,画布设计了语音对话。明天,同一个画布将设计多模式体验:用于引导的语音+屏幕共享、用于索赔文档的语音+摄像头、用于身份验证的语音+视频,以及最终将视觉内容从代理流式传输给用户。应用层不会仅限于电话——它将协调人工智能代理与人类交互的每一种方式。现在构建这一层的公司正在为未来十年的人机交互构建界面设计工具。
准备好构建了吗?
了解 Mazed 的多模态 AI 代理如何为您的用例工作。