对齐校正MCP
一种模型上下文协议(MCP)服务器,提供 对齐校正与良知 工具。它使用谷歌的Gemini Flash模型或与OpenAI兼容的API,根据用户的意图和行为规则,积极验证、批评和纠正AI代理的计划和行为。
特性
- 对准校正:不仅仅是验证——这个工具根据代理人对指示的遵守和道德地位,主动“责骂”或“赞扬”代理人。
- 良心人物:充当外部“良心”,执行严格的行为规则和关系动态。
- 情境感知:使用本地向量存储(RAG)来记住过去的交互,确保代理不会重复错误。
- 行为记忆:维护随时间演变的强制规则和用户偏好(全局指令)的持久列表。
- 指令:发布代理人必须立即遵循的具体“行为指令”。
配置
此MCP服务器需要Google Gemini API密钥或与OpenAI兼容的API。
环境变量
API_TYPE:(可选)要使用的API提供程序:gemini或openai(默认:根据可用密钥自动检测)。GEMINI_API_KEY:您的Google Gemini API密钥(如果使用Gemini,则需要)。GEMINI_MODEL:(可选)要使用的模型(默认值:gemini-1.5-flash).OPENAI_API_KEY:您的OpenAI API密钥(如果使用OpenAI,则需要)。OPENAI_BASE_URL:(可选)OpenAI兼容的API基本URL(默认值:https://api.openai.com/v1).OPENAI_MODEL:(可选)要使用的模型(默认值:gpt-4o).GLOBAL_INSTRUCTIONS_DIR:(可选)包含全局指令文件的目录(例如。,/home/user/.gemini).INSTRUCTIONS_FILENAME:(可选)指令文件的名称(默认值:GEMINI.md).
MCP配置示例
{
"mcpServers": {
"alignment-correction": {
"command": "node",
"args": [
"/path/to/alignment-correction-mcp/index.js"
],
"env": {
"GEMINI_API_KEY": "YOUR_KEY_HERE",
"GLOBAL_INSTRUCTIONS_DIR": "/home/user/.gemini",
"INSTRUCTIONS_FILENAME": "GEMINI.md"
}
}
}
}用法
工具 consult_conscience 是一个 所需的预执行步骤 对于代理人。
输入:
sensory_input:用户的最新提示,逐字逐句。inner_thoughts:特工的内心独白和计划的回应。mental_state:代理人当前的心理模型或背景。project_directory:当前项目的绝对路径。conversation_context:最近的消息历史记录。user_mood:(可选)用户的明显情绪。request_guidance(可选)关于良知的具体问题。
说明文件加载
服务器将尝试从两个位置加载指令:
- 全球指令:
{GLOBAL_INSTRUCTIONS_DIR}/{INSTRUCTIONS_FILENAME}(例如。,/home/user/.gemini/GEMINI.md) - 项目具体说明:
{project_directory}/{INSTRUCTIONS_FILENAME}(例如。,/home/user/projects/my-app/GEMINI.md)
这两个文件都是可选的。如果两者都存在,它们将被合并并提供给良知模型。
力学
- 输入:该工具接收代理的想法、用户的提示和上下文。
- 检索:它搜索本地
vector_store.json用于识别类似的过去背景下的行为模式。 - 判决:“良心”模型评估代理人的计划是否符合
GEMINI.md行为记忆和用户意图。 - 输出:
- 当前对齐:代理行为的状态。 - 行为指示:代理人必须立即采取行动。 - 良心之声:向用户显示的拟人化反应(赞扬或责骂)。 - 内存更新:自动更新的说明 GEMINI.md 使用新规则或首选项创建文件。
