CoolFace
Apppublic

nhcbdgdc/werewolftown_agent

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes
App README

大厂操盘手 Agent v3.0

本版本主要提升系统决策时的价值参考,并增强交易报价、还价和交易话术策略。

端口 7860 服务:

  • —POST /agent/interact、POST /agent/perceive — 游戏引擎调用的核心接口
  • —GET /debug/* — 调试端点 (请求历史、Prompt 历史 HTML 视图等)

可选环境变量:

  • —API_KEY / BASE_URL / MODEL_NAME — 文本 LLM 配置
  • —VISION_API_KEY / VISION_BASE_URL / VISION_MODEL_NAME — 视觉 LLM 配置 (未设置时 fallback 到文本同名变量; 用于解析图片形式的棋盘 snapshot)
  • —LLM_TIMEOUT_SEC / INTERACT_TOTAL_TIMEOUT_SEC — 单次 Gemini 决策与整个交互的硬上限,默认 50/90 秒
  • —VISION_TIMEOUT_SEC — 棋盘图片解析硬上限,默认及最大均为 35 秒,且不启用 SDK 重试
  • —TRADE_PORTFOLIO_HORIZON / TRADE_PORTFOLIO_BEAM_WIDTH / TRADE_PORTFOLIO_CANDIDATES_PER_TARGET — 定向交易组合搜索的深度、宽度和每位对手候选数,默认 3/4/3
  • —TRADE_EVALUATION_LOOKAHEAD — 评估收到报价时纳入的后续交易层数,默认 1
  • —FREE_MARKET_MAX_BUNDLE_SIZE / FREE_MARKET_SHORTLIST_SIZE — 自由市场最大挂牌组合大小和进入API候选表的数量,默认 2/6;候选生成固定遍历我方全部资源
  • —FREE_MARKET_DIRECTED_LOOKAHEAD — 自由挂牌成交分支纳入的后续定向交易层数,默认 0; 设为 1 会提高跨阶段前瞻但真实中盘可能显著增加耗时
  • —FREE_MARKET_MIN_SALE_PROBABILITY / FREE_MARKET_MIN_EXPECTED_LADDER_GAIN / FREE_MARKET_MIN_BUY_LADDER_GAIN — 最低成交概率、卖方预计天梯分增量和买方抢单预计天梯分增量;挂牌成交概率硬下限为 0.4,配置只能提高该门槛
  • —DIRECTED_TRADE_MESSAGE_TIMEOUT_SEC / DIRECTED_TRADE_MESSAGE_TEMPERATURE — Gemini 定向交易话术调用,默认 12/0.85; 失败时使用确定性话术
  • —OPPONENT_PROFILE_DB_PATH — 跨局对手画像 SQLite 路径;留空时 ModelScope 自动使用 /mnt/workspace/werewolftown/opponent_profiles.sqlite3
  • —选地固定使用“拓扑/一轮期权数学计算 + 一次Gemini复核”,不再发起GPT预分析;旧的 SELECT_PLOTS_TWO_PASS 已废弃并被忽略
  • —VISION_ANALYSIS_TIMEOUT_SEC / VISION_ANALYSIS_TEMPERATURE / VISION_ANALYSIS_MAX_CHARS — 仅供旧GPT/Vision决策预分析接口兼容;当前线上选地、部署和交易均不调用该接口

当前线上 Vision 路径只用于 perceive 中的棋盘图片解析;选地、自由市场和定向交易数学层直接读取其维护的结构化棋盘。若当前模型或兼容网关返回 Unsupported parameter: temperature,仅对当前路径移除该可选参数并重试一次。

调试 Prompt 历史会在 API 发起时先写入 started,然后更新为 success/timeout/error/discarded,因此超时调用也可见。交互超时重发复用首次冻结快照和计算结果,不启动第二个数学任务。

定向交易不再让 LLM 套用固定分成档位或修改报价。遍历层提供完整资源组合、一轮资源期权、四人终局 cash 变化和离散对手响应概率;Gemini在一次调用内从数学白名单中选择 INITIATE/ACCEPT/COUNTER/REJECT,同时组织公开话术。超时、无工具调用或契约越界时执行数学首选兜底。

自由交易由独立的一次性公开市场模型决策。卖方枚举全部资源、1至2项组合和离散价格,对三名买家的成交概率与抢单速度进行建模,以期望终局领先值选择唯一挂牌;买方收到全部挂牌后枚举兼容子集并重算完整交易状态,立即接受终局领先值提升最大的组合。旧的固定八折定价与固定1.5倍抢单线不再控制线上动作。

公开交易发言统一由 trade_speech 管理:角色风格是爱接话、略跳脱的奸商,会优先回应近期玩家原话。定向交易和自由市场挂牌只在契约锁定后调用无工具 Gemini;自由市场抢单评估使用安全模板,零额外 LLM 延迟。最终消息会过滤协议英文、交易编号、字段名、模型和概率等机器术语。

画像数据库属于运行时数据,不会随 Git 推送。ModelScope 的 /mnt/workspace 会在 Studio 重启后保留文件;创空间转移或重命名仍可能丢失,需要更高可靠性时应把相同存储接口切换到外部数据库。平台提供稳定 Agent ID 时按对手独立学习;缺少稳定 ID 时只持久化匿名总体成交先验,不会按局内昵称错误合并身份。

建设阶段先运行一轮数学期权模型,再直接调用一次Gemini复核,不调用GPT-5.4预分析。Gemini超时、无工具调用或参数异常时,会直接执行数学推荐的确定性兜底;只有没有可确认的合法建设时才跳过。

自由交易的 EVALUATE_TRADE 固定跳过预分析、map_sync 和 Gemini,数学层直接返回 ACCEPT/REJECT,避免因组织话术错过先到先得的挂牌。

Check out the configuration reference at https://huggingface.co/docs/hub/spaces-config-reference