Token导航 LogoToken导航TokenDH.com
研究检索只读github未标认证来源可访问clear审计通过

nlp-engineer自然语言处理工程师

Agent Skill

nlp-engineer 用于查找、检索和筛选相关信息,适合在 Codex、Claude、Cursor、Gemini CLI 中需要根据关键词、任务场景或来源线索快速定位候选结果时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

3,345

周安装

134

GitHub Stars

76

下载量

1,083
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

3

许可证

MIT

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:nlp-engineer(自然语言处理工程师)
来源仓库:https://github.com/404kidwiz/claude-supercode-skills
仓库路径:skills/nlp-engineer
安装命令:
npx skills add https://github.com/404kidwiz/claude-supercode-skills --skill nlp-engineer
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。不同来源提供的安装方式可能略有差异;本站展示可直接复制的安装命令,安装前请核对来源页面。

skills.shnpx skills
npx skills add https://github.com/404kidwiz/claude-supercode-skills --skill nlp-engineer

简介

nlp-engineer 用于查找、检索和筛选相关信息,适合在 Codex、Claude、Cursor、Gemini CLI 中快速定位候选结果。

  • 适用于关键词搜索、任务场景匹配或来源线索筛选等研究检索场景。
  • 通过 npx skills add 命令从 GitHub 仓库安装,需确认权限与维护状态。
  • 使用前应核实是否会触发联网、命令执行或文件读写操作。
  • 建议结合原始 README 和仓库路径进一步了解具体功能与限制。

SKILL.md

NLP Engineer

Purpose

Provides expertise in Natural Language Processing systems design and implementation. Specializes in text classification, named entity recognition, sentiment analysis, and integrating modern LLMs using frameworks like Hugging Face, spaCy, and LangChain.

When to Use

  • Building text classification systems
  • Implementing named entity recognition (NER)
  • Creating sentiment analysis pipelines
  • Fine-tuning transformer models
  • Designing LLM-powered features
  • Implementing text preprocessing pipelines
  • Building search and retrieval systems
  • Creating text generation applications

Quick Start

Invoke this skill when:

  • Building NLP pipelines (classification, NER, sentiment)
  • Fine-tuning transformer models
  • Implementing text preprocessing
  • Integrating LLMs for text tasks
  • Designing semantic search systems

Do NOT invoke when:

  • RAG architecture design → use /ai-engineer
  • LLM prompt optimization → use /prompt-engineer
  • ML model deployment → use /mlops-engineer
  • General data processing → use /data-engineer

Decision Framework

NLP Task Type?
├── Classification
│   ├── Simple → Fine-tuned BERT/DistilBERT
│   └── Zero-shot → LLM with prompting
├── NER
│   ├── Standard entities → spaCy
│   └── Custom entities → Fine-tuned model
├── Generation
│   └── LLM (GPT, Claude, Llama)
└── Semantic Search
    └── Embeddings + Vector store

Core Workflows

1. Text Classification Pipeline

  1. Collect and label training data
  2. Preprocess text (tokenization, cleaning)
  3. Select base model (BERT, RoBERTa)
  4. Fine-tune on labeled dataset
  5. Evaluate with appropriate metrics
  6. Deploy with inference optimization

2. NER System

  1. Define entity types for domain
  2. Create labeled training data
  3. Choose framework (spaCy, Hugging Face)
  4. Train custom NER model
  5. Evaluate precision, recall, F1
  6. Integrate with post-processing rules

3. Embedding-Based Search

  1. Select embedding model (sentence-transformers)
  2. Generate embeddings for corpus
  3. Index in vector database
  4. Implement query embedding
  5. Add hybrid search (keyword + semantic)
  6. Tune similarity thresholds

Best Practices

  • Start with pretrained models, fine-tune as needed
  • Use domain-specific preprocessing
  • Evaluate with task-appropriate metrics
  • Consider inference latency for production
  • Implement proper text cleaning pipelines
  • Use batching for efficient inference

Anti-Patterns

Anti-PatternProblemCorrect Approach
Training from scratchWastes data and computeFine-tune pretrained
No preprocessingNoisy inputs hurt performanceClean and normalize text
Wrong metricsMisleading evaluationTask-appropriate metrics
Ignoring class imbalanceBiased predictionsBalance or weight classes
Overfitting to eval setPoor generalizationProper train/val/test splits

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

04

需要参考平台分布和安装热度时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Claude Code

28.73%
按下载量换算311

OpenCode

24.44%
按下载量换算265

Codex

20.68%
按下载量换算224

Cursor

12.51%
按下载量换算135

Gemini CLI

8.01%
按下载量换算87

Antigravity

3.32%
按下载量换算36

安全审计

Gen Agent Trust Hub

通过

Socket

通过

Snyk

通过

权限和风险

只读

该 Skill 主要提供规则、说明或参考内容,本身偏只读;真正读写文件、联网或执行命令仍取决于宿主 Agent 的任务。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。

来源信息

继续浏览同类 Skills