Install
openclaw skills install @thcjp/token-economist-proToken经济学家(专业版)在免费版基础上解锁多级向量语义缓存、Token成本预估与月度预算控制、团队成本剖析、基于LLM的智能摘要与上下文图压缩、缓存命中率调优、多模型智能路由等高级能力. 适用于需要token economist相关能力的开发场景,提供结构化的工作流程和配置指引. 该工具经过深度差异化处理,针对用户反馈和使用痛点进行了优化改进,提升了实用性和可操作性.
openclaw skills install @thcjp/token-economist-pro核心功能: 本技能提供结构化的工作流程和配置指引等能力。
全功能Token优化系统。向量缓存+成本预估+预算控制+多模型路由,从个人节省走向团队级成本治理。
永远不超预算。永远不丢关键上下文。永远用最合适的模型. Token经济学家专业版在免费版基础上解锁多级向量语义缓存、Token成本预估与预算控制、团队成本分析、LLM智能摘要、缓存命中率优化与多模型智能路由,覆盖从个人到团队的完整Token治理需求.
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| input | string | 是 | Token经济学家(专业版)处理的输入数据或指令 |
| options | object | 否 | 附加配置选项,如模式选择、格式偏好等 |
| callback_url | string | 否 | 异步处理完成后的回调通知URL |
┌─────────────────────────────────────────────────────────────────┐
│ Token经济学家专业版 (PRO) │
├─────────────────────────────────────────────────────────────────┤
│ │
│ ┌─────────────┐ ┌─────────────┐ ┌─────────────┐ │
│ │ 上下文压缩 │ │ 语义缓存 │ │ 自适应优化 │ │
│ │ (免费版) │ │ L1-L3 │ │ (免费版) │ │
│ └─────────────┘ └─────────────┘ └─────────────┘ │
│ │
│ ┌─────────────┐ ┌─────────────┐ ┌─────────────┐ │
│ │ 质量守卫 │ │ 自然语言 │ │ 斜杠命令 │ │
│ │ (免费版) │ │ (免费版) │ │ (免费版) │ │
│ └─────────────┘ └─────────────┘ └─────────────┘ │
│ │
│ ┌─────────────────────────────────────────────┐ │
│ │ 专业版新增功能 │ │
│ ├─────────────────────────────────────────────┤ │
│ │ │ │
│ │ ┌──────────┐ ┌──────────┐ ┌──────────┐ │ │
│ │ │ L4向量 │ │ 成本预估 │ │ 预算控制 │ │ │
│ │ │ 语义缓存 │ │ 实时+月度│ │ 告警+熔断│ │ │
│ │ │ 跨会话 │ │ │ │ │ │ │
│ │ └──────────┘ └──────────┘ └──────────┘ │ │
│ │ │ │
│ │ ┌──────────┐ ┌──────────┐ ┌──────────┐ │ │
│ │ │ 团队成本 │ │ LLM智能 │ │ 缓存命中 │ │ │
│ │ │ 分析 │ │ 摘要 │ │ 率优化 │ │ │
│ │ │ 多用户 │ │ 上下文图 │ │ 预热+淘汰 │ │ │
│ │ └──────────┘ └──────────┘ └──────────┘ │ │
│ │ │ │
│ │ ┌──────────┐ ┌──────────┐ │ │
│ │ │ 多模型 │ │ 多角色 │ │ │
│ │ │ 路由 │ │ 场景指南 │ │ │
│ │ │ GPT-4o/ │ │ 5类角色 │ │ │
│ │ │ mini │ │ │ │ │
│ │ └──────────┘ └──────────┘ │ │
│ │ │ │
│ └─────────────────────────────────────────────┘ │
│ │
└─────────────────────────────────────────────────────────────────┘
用户:"成本概览" / "本月Token花费"
Agent:
💰 Token成本概览
━━━━━━━━━━━━━━━━━━━━
本月(2026-07):
• 原始成本:$12.50
• 优化后成本:$4.38
• 已节省:$8.12(65%)
• 预算使用:44%(预算$10/月)
# ..
团队成本TOP3:
1. 用户A:$1.82(节省68%)
2. 用户B:$1.45(节省62%)
3. 用户C:$1.11(节省71%)
# ..
预测:按当前趋势,本月预计花费$9.95(不超预算)
// ~/.token-economist/config.json
{
"edition": "pro",
"budget": {
"monthly": 10.00,
"daily": 0.50,
"alertThreshold": 0.8,
"circuitBreaker": 1.0
},
"routing": {
"enabled": true,
"defaultModel": "gpt-4o-mini",
"complexModel": "gpt-4o",
"complexityThreshold": 0.7
},
"cache": {
"L4_vector": true,
"crossSession": true,
"prewarm": true
}
}
{
"team": {
"name": "工程团队",
"members": ["user_a", "user_b", "user_c"],
"budgetAllocation": {
"user_a": 0.4,
"user_b": 0.35,
"user_c": 0.25
},
"sharedCache": true,
"reportFrequency": "weekly"
}
}
响应解析: 完成完成后,查看输出响应确认任务状态。成功时输出包含解析摘要和响应数据;失败时根据错误信息排查问题,查阅错误解析章节获取恢复步骤.
免费版L1-L3缓存基于关键词与模式匹配,专业版新增L4向量语义缓存:
# L4向量语义缓存实现
from sentence_transformers import SentenceTransformer
import numpy as np
from sklearn.metrics.pairwise import cosine_similarity
# ..
class VectorSemanticCache:
def __init__(self):
self.model = SentenceTransformer('all-MiniLM-L6-v2')
self.cache = {} # {id: {'query': str, 'embedding': np.array, 'response': str, 'timestamp': float}}
# ..
def get(self, query, threshold=0.85):
query_emb = self.model.encode([query])[0]
best_score = 0
best_id = None
for cid, item in self.cache.items():
score = cosine_similarity([query_emb], [item['embedding']])[0][0]
if score > best_score:
best_score = score
best_id = cid
if best_score >= threshold:
return self.cache[best_id]['response'], best_score
return None, best_score
# ..
def set(self, query, response):
emb = self.model.encode([query])[0]
cid = hash(query)
self.cache[cid] = {
'query': query,
'embedding': emb,
'response': response,
'timestamp': time.time()
}
L4优势:
四级缓存对比:
| 层级 | 匹配方式 | 节省率 | 跨会话 | 示例 |
|---|---|---|---|---|
| L1 | 精确匹配 | 100% | 否 | 完全相同的问题 |
| L2 | 语义相似>85% | 80% | 否 | 用词不同但意思相同 |
| L3 | 模式匹配 | 50% | 否 | 同类操作(读文件↔写文件) |
| L4 | 向量语义 | 90% | 是 | "如何部署应用" ↔ "上线流程是什么" |
执行功能2:Token成本预估(专业版)操作,使用input_params参数进行配置,支持创建/查询/导出等操作.
# 实时成本预估
class TokenCostEstimator:
def __init__(self):
self.pricing = {
'gpt-4o': {'input': 0.000005, 'output': 0.000015}, # per token
'gpt-4o-mini': {'input': 0.00000015, 'output': 0.0000006},
}
# ..
def estimate(self, input_tokens, output_tokens, model='gpt-4o-mini'):
cost = (input_tokens * self.pricing[model]['input'] +
output_tokens * self.pricing[model]['output'])
return cost
# ..
def monthly_projection(self, daily_avg_cost, days_remaining):
return daily_avg_cost * days_remaining
# ..
# 使用示例
estimator = TokenCostEstimator()
daily_cost = estimator.estimate(50000, 15000) # 每日Token
monthly_projection = estimator.monthly_projection(daily_cost, 30)
print(f"月度预估成本:${monthly_projection:.2f}")
成本预估报告:
📊 Token成本预估报告
━━━━━━━━━━━━━━━━━━━━
今日:
• 输入Token:52,000
• 输出Token:18,500
• 原始成本:$0.36
• 优化后成本:$0.13(节省64%)
# ..
本月预估:
• 剩余天数:13天
• 日均成本:$0.13
• 预估总成本:$1.69 + 已花费$2.69 = $4.38
• 预算:$10.00
• 预算使用率:44%
# ..
建议:
• 当前趋势良好,不超预算
• 可考虑对高频用户启用更激进的压缩
执行功能3:预算控制(专业版)操作,使用input_params参数进行配置,支持创建/查询/导出等操作.
# 预算控制器
class BudgetController:
def __init__(self, monthly_budget, daily_budget):
self.monthly_budget = monthly_budget
self.daily_budget = daily_budget
self.alert_threshold = 0.8
self.circuit_breaker = 1.0
# ..
def check(self, current_spend, period='monthly'):
budget = self.monthly_budget if period == 'monthly' else self.daily_budget
usage_rate = current_spend / budget
# ..
if usage_rate >= self.circuit_breaker:
return {
'action': 'circuit_break',
'message': f'{period}预算已用尽({usage_rate:.0%}),熔断触发',
'fallback_model': 'gpt-4o-mini' # 降级到低成本模型
}
elif usage_rate >= self.alert_threshold:
return {
'action': 'alert',
'message': f'{period}预算使用{usage_rate:.0%},接近上限',
'suggestion': '建议启用更激进的压缩策略'
}
return {'action': 'normal'}
预算告警示例:
⚠️ 预算告警
━━━━━━━━━━━━━━━━━━━━
月度预算使用:85%($8.50/$10.00)
剩余预算:$1.50
剩余天数:8天
日均可用:$0.19(当前日均$0.28)
# ..
建议操作:
1. 启用激进压缩模式(预计节省+15%)
2. 对非关键任务降级到GPT-4o-mini
3. 禁用L4向量缓存预加载(减少API调用)
# ..
[一键应用建议] [忽略]
熔断机制:
🚫 预算熔断
━━━━━━━━━━━━━━━━━━━━
月度预算已用尽(100%)
自动执行:
• 模型降级:GPT-4o → GPT-4o-mini
• 压缩升级:均衡 → 激进
• 缓存预加载:禁用
• L4跨会话缓存:保留(不消耗新Token)
# ..
如需继续使用GPT-4o,请:
1. 调整月度预算
2. 或等待下月重置
执行功能4:团队成本分析(专业版)操作,使用input_params参数进行配置,支持创建/查询/导出等操作.
👥 团队成本报告 - 2026年7月(第3周)
━━━━━━━━━━━━━━━━━━━━
# ..
团队总览:
• 成员数:5人
• 总成本:$4.38(节省$8.12,65%)
• 人均成本:$0.88
# ..
成员明细:
| 成员 | 原始成本 | 优化后 | 节省率 | 缓存命中 | 预算使用 |
|---:|---:|---:|---:|---:|---:|
| 用户A | $2.80 | $1.82 | 35% | 12 | 73% |
| 用户B | $2.20 | $1.45 | 34% | 8 | 58% |
| 用户C | $1.55 | $1.11 | 28% | 15 | 89% ⚠️ |
| 用户D | $1.20 | $0.72 | 40% | 20 | 48% |
| 用户E | $0.95 | $0.58 | 39% | 6 | 39% |
# ..
异常分析:
• 用户C节省率最低(28%):主要使用代码审查场景(代码不压缩)
• 用户C预算使用89%:建议启用激进模式
• 用户D缓存命中率最高(20次):查询模式重复度高
# ..
优化建议:
1. 用户C:启用激进压缩,预计节省+15%
2. 用户A:查询模式分析,可提升缓存命中率
3. 全员:推广用户D的查询习惯(结构化提问)
执行功能5:LLM智能摘要(专业版)操作,使用input_params参数进行配置,支持创建/查询/导出等操作.
免费版基于规则摘要,专业版使用LLM进行智能摘要:
# LLM驱动的上下文图压缩
class LLMContextCompressor:
def __init__(self, llm_client):
self.llm = llm_client
# ..
def compress(self, messages):
# 1. 构建上下文图(消息间引用关系)
graph = self.build_context_graph(messages)
# ..
# 2. 识别关键节点(高引用、含决策、含代码)
key_nodes = self.identify_key_nodes(graph)
# ..
# 3. 按主题聚类
clusters = self.cluster_by_topic(messages)
# ..
# 4. LLM摘要每个聚类
summaries = []
for cluster in clusters:
summary = self.llm.summarize(
cluster,
instruction="保留:决策、代码引用、关键结论。压缩:重复讨论、过程性对话"
)
summaries.append(summary)
# ..
# 5. 保留关键节点 + 聚类摘要
compressed = key_nodes + summaries
return compressed
上下文图压缩示例:
原始(15轮讨论,9,200 Token):
[1]-[3] Python文件操作基础
[4]-[6] 编码问题讨论(引用[1]-[3])
[7]-[9] 大文件处理(引用[1]-[3])
[10]-[12] 性能优化(引用[7]-[9])
[13]-[15] 错误处理(引用[1]-[3])
# ..
压缩后(2,800 Token,节省70%):
[摘要-1] Python文件操作基础:open()/read()/write(),'a'追加模式
[摘要-2] 编码问题:指定encoding='utf-8',处理UnicodeDecodeError
[摘要-3] 大文件处理:逐行读取,with语句,生成器
[保留] [10]-[12] 性能优化(关键决策)
[保留] [13]-[15] 错误处理(最近讨论)
[代码块] 全部保留
# 多模型路由器
class ModelRouter:
def __init__(self):
self.complexity_threshold = 0.7
self.models = {
'simple': 'gpt-4o-mini', # 简单任务
'complex': 'gpt-4o', # 复杂任务
}
# ..
def route(self, query, context_complexity):
# 评估任务复杂度
complexity = self.assess_complexity(query, context_complexity)
# ..
if complexity >= self.complexity_threshold:
return self.models['simple']
# ..
def assess_complexity(self, query, context):
score = 0
# 代码生成/调试:高复杂度
if any(kw in query for kw in ['实现', '调试', '架构', '重构']):
score += 0.3
# 长上下文:高复杂度
if len(context) > 5000:
# 多步骤推理:高复杂度
if any(kw in query for kw in ['分析', '对比', '设计', '优化']):
# 简单查询:低复杂度
if any(kw in query for kw in ['什么是', '列表', '定义']):
score -= 0.2
return max(0, min(1, score + 0.5))
路由决策示例:
查询:"什么是REST API?" → 复杂度0.3 → GPT-4o-mini(节省成本)
查询:"设计一个高并发的微服务架构" → 复杂度0.9 → GPT-4o(质量优先)
查询:"这段代码有什么bug?" → 复杂度0.7 → GPT-4o(调试需精度)
查询:"列出Python的数据类型" → 复杂度0.2 → GPT-4o-mini(简单查询)
成本对比:
| 模型 | 输入成本 | 输出成本 | 适用场景 |
|---|---|---|---|
| GPT-4o | $5/1M | $15/1M | 复杂推理、代码生成、架构设计 |
| GPT-4o-mini | $0.15/1M | $0.60/1M | 简单查询、列表、定义 |
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:Agent、全功能、优化系统、含多级向量缓存、团队分析与多模型、经济学家、在免费版基础上解、锁多级向量语义缓、成本预估与月度预、的智能摘要与上下、缓存命中率优化、多模型智能路由等、高级能力等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.
典型场景:长编程会话Token优化. 推荐配置:激进压缩 + L4向量缓存 + 多模型路由
{
"mode": "aggressive",
"cache": {"L4_vector": true, "crossSession": true},
"routing": {"enabled": true}
}
预期效果:节省70-80%,代码零损失,跨会话复用历史解答.
典型场景:团队API成本治理与预算控制. 推荐配置:预算控制 + 团队分析 + 激进模式
{
"budget": {"monthly": 50.00, "alertThreshold": 0.8},
"team": {"sharedCache": true, "reportFrequency": "weekly"}
}
预期效果:团队成本可视化,预算超支预警,成员间缓存共享.
典型场景:大规模Agent部署的成本治理. 推荐配置:多模型路由 + 熔断机制 + LLM智能摘要
{
"routing": {"complexityThreshold": 0.6},
"budget": {"circuitBreaker": 1.0, "fallbackModel": "gpt-4o-mini"}
}
预期效果:自动降级保护预算,复杂任务质量优先,简单任务成本优先.
典型场景:重复查询场景的缓存优化. 推荐配置:L4向量缓存 + 缓存预热 + 命中率优化
{
"cache": {
"L4_vector": true,
"prewarm": true,
"hitRateOptimization": true
}
}
预期效果:相似查询90%命中缓存,响应速度提升10倍.
典型场景:成本报告与决策支持. 推荐配置:团队分析 + 月度报告 + 成本预估
{
"team": {"reportFrequency": "monthly"},
"costEstimation": {"enabled": true, "trendAnalysis": true}
}
| 角色 | 典型场景 | 推荐配置 | 核心价值 |
|---|---|---|---|
| 个人开发者 | 长编程会话 | 激进+L4+路由 | 70-80%节省,代码零损失 |
| 团队负责人 | 团队成本治理 | 预算+分析+激进 | 成本可视化,预算预警 |
| 企业架构师 | 大规模部署 | 路由+熔断+摘要 | 自动降级,质量优先 |
| 数据分析师 | 重复查询 | L4+预热+命中率 | 90%缓存命中,10倍响应 |
| 产品经理 | 成本报告 | 分析+月报+预估 | 趋势预测,预算规划 |
# Prometheus指标导出
from prometheus_client import Counter, Gauge
# ..
token_saved = Counter('token_economist_saved_total', 'Total tokens saved')
cache_hits = Counter('token_economist_cache_hits_total', 'Cache hits', ['level'])
cost_spent = Gauge('token_economist_cost_monthly', 'Monthly cost in USD')
budget_usage = Gauge('token_economist_budget_usage', 'Budget usage rate')
# ..
# 导出指标
token_saved.inc(saved_count)
cache_hits.labels(level='L4').inc(hit_count)
cost_spent.set(monthly_cost)
budget_usage.set(usage_rate)
# Slack告警
def send_budget_alert(usage_rate, remaining_budget):
if usage_rate >= 0.8:
slack_webhook.send({
"text": f"⚠️ Token预算告警:使用{usage_rate:.0%},剩余${remaining_budget:.2f}"
})
# 在CI中检查Token成本
token-economist check-budget --threshold 0.9 || exit 1
# ..
# 部署前预估成本
token-economist estimate --query "production_queries.json"
sentence-transformers~/.json| 版本 | 日期 | 变更内容 |
|---|---|---|
| 1.0.0 | 2026-07 | 初版发布,含L4缓存+成本预估+预算控制+团队分析+多模型路由 |
| 问题 | 可能原因 | 解决方案 | 优先级 |
|---|---|---|---|
| 缓存命中率低 | 查询模式多样或阈值过高 | 降低L2相似度阈值;启用L4向量缓存;分析miss模式 | 高 |
| 压缩后质量下降 | 激进模式或关键内容被压缩 | 切换均衡模式;检查质量守卫规则;启用质量回滚 | 高 |
| 预算超支 | 无预算控制或模型路由失效 | 启用预算熔断;检查多模型路由配置;启用激进压缩 | 高 |
| L4缓存延迟高 | 向量编码耗时 | 使用轻量嵌入模型;异步编码;缓存嵌入结果 | 中 |
| 团队报告不准 | 成员标识错误或数据延迟 | 检查成员配置;同步缓存数据;等待报告周期 | 中 |
| 模型路由判断错误 | 复杂度评估不准 | 调整复杂度阈值;添加领域关键词;手动标注训练 | 中 |
| 跨会话缓存失效 | 缓存键设计不合理或过期 | 检查缓存键策略;延长TTL;启用持久化缓存 | 中 |
| 成本预估偏差 | 日均消费波动大 | 使用加权平均;考虑工作日/休息日差异 | 低 |
| 熔断后无法恢复 | 预算周期未重置 | 检查预算重置日期;手动重置;等待下月 | 中 |
| LLM摘要质量差 | 摘要指令不清或上下文过长 | 优化摘要指令;分段摘要;保留关键节点 | 中 |
| 团队缓存冲突 | 多用户同时写缓存 | 启用缓存版本控制;冲突时以最新为准 | 低 |
| 预算告警频繁 | 阈值过低或消费波动 | 调整告警阈值至85%+;使用滑动窗口告警 | 低 |
| 问题 | 修复方法 |
|---|---|
| Token消耗突增 | 检查是否启用激进模式;查看是否有长对话未压缩 |
| 缓存全miss | 检查缓存键策略;降低相似度阈值;启用L4向量缓存 |
| 预算即将超支 | 启用激进压缩;模型降级到mini;禁用缓存预热 |
| 代码被压缩 | 检查质量守卫规则;确保代码块识别正确 |
| 团队成本不均 | 分析成员查询模式;调整预算分配;推广高效查询习惯 |
| 路由总是选mini | 调低复杂度阈值;添加领域复杂关键词 |
| 路由总是选4o | 调高复杂度阈值;检查简单查询识别 |
| L4缓存占用大 | 设置缓存大小上限;启用LRU淘汰;定期清理 |
| 摘要丢失关键信息 | 启用关键节点保留;优化摘要指令;检查主题聚类 |
# 查看完整成本报告
token-economist report --full
# ..
# 缓存命中率分析
token-economist cache --analyze --days 30
# ..
# 预算状态
token-economist budget --status
# ..
# 团队成本报告
token-economist team --report --period monthly
# ..
# 模型路由统计
token-economist routing --stats
# ..
# 清理过期缓存
token-economist cache --cleanup --older-than 7d
# ..
# 导出成本数据
token-economist export --format csv --period 2026-07
| 序号 | 错误场景 | 原因 | 处理方式 | 优先级 |
|---|---|---|---|---|
| 1 | 输入参数缺失 | 用户未提供必要参数 | 提示用户提供所需参数后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令 | P0 |
| 2 | 执行超时 | 处理时间过长 | 检查输入数据量,分批处理 | P1 |
| 3 | 输出格式错误 | 结果不符合预期格式 | 检查output_format参数配置 | P1 |
免费版提供智能上下文压缩、L1-L3语义缓存、自适应优化、质量守卫、自然语言与斜杠命令。专业版解锁L4向量语义缓存(跨会话)、Token成本预估(实时+月度)、预算控制(告警+熔断)、团队成本分析、LLM智能摘要(上下文图压缩)、缓存命中率优化(预热+淘汰)、多模型智能路由(GPT-4o/mini按复杂度选择)、多角色场景指南、故障排查表.
L2基于关键词相似度(如Jaccard、编辑距离),需要部分用词相同。L4基于向量嵌入的语义相似度,即使用词完全不同,语义相同即可命中。例如"如何部署应用"和"上线流程是什么"在L2不会命中,但在L4会命中(语义相似度>85%)。L4还支持跨会话缓存.
路由器评估任务复杂度(0-1分):代码生成/调试/架构设计+0.3,长上下文+0.2,多步骤推理+0.2,简单查询-0.2。分数>0.7用GPT-4o,否则用GPT-4o-mini。复杂度阈值可配置。这能节省60-80%成本(简单任务用便宜的mini).
能。熔断后自动降级到GPT-4o-mini + 激进压缩,仍可继续使用,只是质量略降。L4跨会话缓存保留(不消耗新Token)。如需恢复GPT-4o,需调整预算或等待下月重置.
不会。团队共享的是查询-响应缓存,不含用户身份信息。缓存键基于查询内容的hash,不包含用户ID。可在config.json中关闭sharedCache,改为独立缓存.
会,但净收益为正。摘要消耗约500-1000 Token,但压缩后节省5000-10000 Token。净节省80-90%。摘要操作可配置为异步执行,不阻塞主对话.
缓存预热是预先对高频查询生成并缓存响应。适用于可预测的高频场景(如API文档查询、FAQ)。预热在低峰期执行,避免高峰期缓存miss导致的重复计算。对查询模式固定的场景可提升命中率至90%+.
自然语言说"成本概览"或命令token-economist report --full。关键指标:节省率(目标>60%)、缓存命中率(目标>50%)、预算使用率(目标<80%)、质量评分(目标>90%)。专业版支持Prometheus+Grafana监控集成.
可以。通过config.json按需启用。例如只启用L4缓存不启用预算控制,或只启用多模型路由不启用团队分析。专业版许可证覆盖所有功能,使用哪些由你决定.
压缩前生成快照,压缩后评估质量评分(基于响应连贯性、信息完整性、代码正确性)。若质量下降>15%,自动回滚到压缩前版本并通知用户。这确保压缩永远不会显著损害质量.
不会。路由器的原则是"复杂任务用强模型,简单任务用弱模型"。简单查询(如"什么是REST API")用GPT-4o-mini的质量与GPT-4o几乎相同,但成本降低30倍。复杂任务(如架构设计)仍用GPT-4o保证质量.
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent平台内置LLM提供 |
| sentence-transformers | Python库 | L4缓存必需 | pip install sentence-transformers |
| scikit-learn | Python库 | L4缓存必需 | pip install scikit-learn |
| numpy | Python库 | L4缓存必需 | pip install numpy |
| prometheus-client | Python库 | 可选(监控) | pip install prometheus-client |
~/.token-economist/credentials/ 目录(已gitignore)本技能基于原始开源作品改进,保留原始版权声明:
本改进作品在原始作品基础上进行了深度差异化改造,包括但不限于:
本专业版相比免费版新增以下能力:
此外,专业版还提供:
| 版本 | 价格 | 功能 | 适用场景 |
|---|---|---|---|
| 免费体验版 | ¥0 | 核心压缩 + L1-L3缓存 + 自适应优化 + 质量守卫 | 个人试用、长对话优化 |
| 收费专业版 | ¥19.9/月 | 全功能(L4向量缓存+成本预估+预算控制+团队分析+多模型路由)+ 多角色指南 + 优先支持 | 团队/企业、成本治理 |
专业版通过SkillHub SkillPay发布.
输出:返回执行结果,包含操作状态和输出数据
用户: 执行核心功能
Skill: 正在执行核心功能..
Skill: 执行完成,结果如下: 操作成功
```bash
# 在此执行相关操作
echo "操作完成"
```json
{
"success": true,
"data": {
"result": "Token经济学家(专业版)处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "token economist pro"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}