如果你的后端是 Go,这篇教程给你一个能直接嵌进现有服务的最小实现:用官方 Go Agent SDK 起三个接口——/get_config、/startAgent、/stopAgent。 浏览器端直接…
如果你的后端是 Go,这篇教程给你一个能直接嵌进现有服务的最小实现:用官方 Go Agent SDK 起三个接口——/get_config、/startAgent、/stopAgent。 浏览器端直接…
让大模型当地下城主持人,讲故事的部分它做得很好;但让它同时管生命值、掷骰和掉落,就会出现「刚才你还剩 30 点血,现在怎么变成 50 了」这种问题。同一个动作问两遍,可能得到两个互相矛盾的结果。 这篇…
标准链路是 LLM 出文字、TTS 变声音。但有些场景绕不开自己的音频:品牌代言人的录音、游戏里的角色音效、自研的语音模型、已经合成好的固定话术。 把 llm.output_modalities 设成…
在开放办公区、展厅、客厅这种地方,旁边人随口一句话就可能被智能体当成指令。用户正说到一半,同事在两米外聊天,智能体转头回答同事去了——这个问题在 Demo 里不存在,一到真实环境就非常明显。 选择性注…
用一个通用提示词同时干分诊、报价、下单、售后,结果通常是四件事都干得含糊——售前的话术混进售后,退款问题被当成销售机会。 更清楚的做法是拆角色:分诊客服先识别需求,售前顾问回答套餐和购买问题,创建订单…
翻译智能体和问答智能体有个根本区别:它绝不能回答用户说的话。 用户说「我们周五开会你能参加吗」,普通助手会回答「可以」;翻译助手必须原样译成英文。这个「不许回答」的约束贯穿全篇。识别语言、系统提示、T…
把几十个业务函数一股脑塞给模型,出问题几乎是必然的:选错工具、参数张冠李戴、执行了本不该执行的操作。工具列表越长,模型判断越容易飘。 更稳的做法是按场景只暴露当下该用的那几个。用智能家居演示最直观:人…
页面关了,事情还得继续。审计、告警、计费、跨系统联动这些事不能指望用户的浏览器一直开着。 所以分工是清楚的:客户端事件负责更新当前页面,服务端 Webhook 负责剩下那些不能丢的部分,由云端主动推给…
文本产品出问题,你还能在前端把内容藏起来。语音不行——模型的输出会直接进 TTS,用户先听到了,你再隐藏字幕已经没有意义。 所以过滤必须往前放,放到 Custom LLM 网关这一层:进模型之前先脱敏…
max_history 只管当前这条命的事——会话一停,智能体就把你忘干净了。想让用户下次打进来还被记得,得在停止前把记忆取出来存好,新会话创建时再注入回去。 这件事技术上不难,难在做得安全。所以下面…
本博客为技术交流与平台行业信息分享平台,内容仅供交流参考,文章内容不代表本公司立场和观点,亦不构成任何出版或销售行为。