·tian
对话中途耗尽的 Token 预算:为什么免费用户觉得你的模型变笨了
按用户分配的 Token 预算往往在对话中途咬人最狠——静默截断、丢弃工具调用、模型回退都会被用户读成质量退化,而升级转化的对话从未发生。
insider
ai-product
freemium
token-budget
+1·tian
智能体任务复杂度估算:执行前先规划 Token 预算
LLM 智能体在不知道任务有多深之前就开始提交资源。本文介绍复杂度估算层——分层路由、预算追踪器注入、计划模板缓存和基于 DAG 的分解——它们能防止不可逆的早期错误,使智能体成本可预测。
insider
agent-architecture
token-budget
task-planning
+1