CrawlForge MCP
AnálisisDeterminista3 credits

analyze_content

Análisis estadístico de contenido: detección de idioma, frecuencia de palabras clave, sentimiento por léxico ponderado y facilidad de lectura Flesch. Indique una URL y la herramienta descarga y limpia la página por usted, o pase el texto directamente. No interviene ninguna llamada a un modelo, así que la misma entrada produce siempre la misma salida.

Casos de uso

Clasificación de contenido

Encamine artículos según el idioma detectado y las palabras clave dominantes antes de que lleguen a una etapa más costosa del pipeline.

Monitoreo de sentimiento

Siga el tono de reseñas y comentarios. Cada puntuación incluye las palabras exactas que la produjeron, de modo que un resultado sorprendente se puede auditar.

Auditoría de legibilidad

Facilidad de lectura Flesch sobre un conjunto de páginas, para encontrar documentación que se ha vuelto más densa que el resto.

Prefiltrado económico

Filtre las páginas extraídas por longitud, idioma y palabras clave antes de gastar credits en summarize_content o extract_with_llm.

Enrutamiento multilingüe

Detecte el idioma de una página y envíela al manejador o traductor adecuado.

Estadísticas del corpus

Recuentos de palabras, oraciones y longitud media de oración en todo un rastreo, para informes o controles de calidad.

Endpoint

POST/api/v1/tools/analyze_content
Auth Required
1 req/s en el plan Free
3 credits

Parameters

NameTypeRequiredDefaultDescription
url
stringOptional-
Página que se descargará y analizará. Se eliminan scripts, estilos, nav, header y footer, y se analiza el texto restante del body. Indique `url` o `content`.
Example: https://example.com/blog/post
content
stringOptional-
Texto para analizar directamente, sin descarga. Solo surte efecto cuando se omite `url`: si envía ambos, gana la página descargada.
Example: The dashboard is a great upgrade...
analyze_sentiment
booleanOptionalfalse
Puntúa el sentimiento con un léxico ponderado en inglés. Desactivado por defecto; el objeto `sentiment` no aparece a menos que lo solicite.
Example: true
extract_keywords
booleanOptionaltrue
Devuelve las diez palabras más frecuentes de más de tres caracteres, con sus recuentos.
Example: true
detect_language
booleanOptionaltrue
Detecta el idioma y devuelve un código ISO 639-1, o `und` cuando el texto es demasiado corto o el idioma no se reconoce.
Example: true
analyze_readability
booleanOptionalfalse
Calcula la facilidad de lectura Flesch y un nivel escolar aproximado. Desactivado por defecto; el objeto `readability` no aparece a menos que lo solicite.
Example: true
timeout
numberOptional10000
Tiempo de espera de la descarga en milisegundos, entre 1000 y 30000. Solo se aplica cuando se usa `url`.
Example: 10000
respect_robots
booleanOptionaltrue
Respeta el robots.txt del sitio de destino. Con el valor `true`, una ruta que robots.txt no permita a `CrawlForge` se rechaza con un 403 antes de descargar nada y no se cobran credits. Póngalo en `false` solo para destinos con los que tenga su propio acuerdo: la respuesta incluye entonces una entrada `warnings` y la anulación queda registrada en su API key.
Example: true

Ejemplos de solicitud

terminalBash
curl -X POST https://crawlforge.dev/api/v1/tools/analyze_content \
  -H "X-API-Key: cf_test_YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "url": "https://example.com/blog/dashboard-review",
    "analyze_sentiment": true,
    "analyze_readability": true
  }'

Ejemplo de respuesta

200 OK310ms
{
"success": true,
"data": {
"content_length": 407,
"word_count": 75,
"sentence_count": 6,
"avg_sentence_length": 13,
"language": "en",
"keywords": [
{
"word": "dashboard",
"frequency": 3
},
{
"word": "easy",
"frequency": 2
},
{
"word": "that",
"frequency": 2
},
{
"word": "great",
"frequency": 1
},
{
"word": "upgrade",
"frequency": 1
}
],
"sentiment": {
"score": 0.924,
"label": "positive",
"positive_matches": [
"great",
"easy",
"clear",
"helpful",
"fast",
"easy",
"reliable",
"recommend"
],
"negative_matches": [],
"method": "lexicon"
},
"readability": {
"flesch_score": 76,
"grade_level": "middle_school"
}
},
"credits_used": 3,
"credits_remaining": 997,
"processing_time": 310
}
Field Descriptions
data.content_lengthNúmero de caracteres del texto analizado, después de eliminar el HTML
data.avg_sentence_lengthPalabras por oración, redondeado a un número entero
data.languageCódigo ISO 639-1, o `und`. Solo aparece cuando `detect_language` es true (el valor por defecto)
data.keywordsLas diez palabras de más de tres caracteres con mayor frecuencia bruta. No hay lista de palabras vacías, así que pueden aparecer palabras comunes como `that` o `with`
data.sentiment.scoreSuma de los pesos del léxico coincidentes dividida por la raíz cuadrada del número de palabras, limitada a -1..1
data.sentiment.label`positive` por encima de 0,05, `negative` por debajo de -0,05, en otro caso `neutral`
data.sentiment.positive_matchesTodas las palabras que aportaron en positivo, en orden y con repeticiones: de esto se compone la puntuación
data.sentiment.methodSiempre `lexicon`. No se llama a ningún modelo
data.readability.flesch_scoreFacilidad de lectura Flesch, limitada a 0-100. Cuanto más alto, más fácil
data.readability.grade_level`middle_school`, `high_school` o `college`, derivado únicamente de la longitud de las oraciones
credits_used3 credits fijos por llamada, sea cual sea la longitud del texto

Manejo de errores

Ni url ni content (400 Bad Request)

VALIDATION_ERROR. Debe estar presente al menos uno de los dos. El mismo estado cubre una url mal formada y un timeout fuera de 1000-30000.

Página demasiado grande (413 Payload Too Large)

RESPONSE_TOO_LARGE. El cuerpo descargado superó el límite de lectura de 25MB y se rechazó en lugar de almacenarse en memoria. Pase el texto usted mismo mediante content si necesita analizarlo.

El destino agotó el tiempo de espera (504 Gateway Timeout)

FETCH_TIMEOUT. La página dejó de responder mientras enviaba su cuerpo. Aumente timeout, hasta 30000 ms.

Fallo en la descarga (502 Bad Gateway)

FETCH_FAILED. No se pudo leer el cuerpo de la respuesta: conexión reiniciada, o un cuerpo que no es texto decodificable.

El análisis falló (500 Internal Server Error)

TOOL_ERROR. Una llamada fallida no se cobra; los credits solo se descuentan después de que el análisis tiene éxito.

Bloqueado por robots.txt (403 Forbidden)

El robots.txt del sitio de destino no permite esta ruta a CrawlForge. Establezca respect_robots: false para anularlo si tiene su propio acuerdo con el destino: la anulación queda registrada en su API key. La anulación no alcanza a un host incluido en la lista de exclusión permanente de CrawlForge, que se rechaza sea cual sea el valor de respect_robots.

Nota: El léxico de sentimiento es solo en inglés. Aplicarlo a texto en otro idioma devuelve una puntuación cercana a cero en lugar de un error, así que revise data.language antes de confiar en data.sentiment.

Costo en credits

3 credits
3 credits por llamada
Tarifa plana tanto si pasa una URL como texto sin formato, y sea cual sea el conjunto de análisis que active. Las llamadas fallidas no se cobran.

Qué incluye:

Detección de idioma (ISO 639-1, basada en trigramas)

Frecuencia de las diez palabras clave principales

Sentimiento por léxico ponderado con las palabras coincidentes

Facilidad de lectura Flesch y nivel escolar

Recuentos de palabras, oraciones y caracteres

Recomendaciones por plan:

Plan Free: 1,000 credits de prueba por única vez = 333 análisis

Plan Hobby: 5,000 credits = 1,666 análisis ($19/mo)

Plan Professional: 50,000 credits = 16,666 análisis ($99/mo)

Herramientas relacionadas

extract_content
Extraiga primero el texto limpio del artículo de una página (2 credits)
summarize_content
Condense una página en lugar de medirla (4 credits)
localization
Detecte el idioma junto con las señales de hreflang y segmentación geográfica (2 credits)
batch_scrape
Recopile muchas páginas y luego analice cada una (5 credits por URL)
¿Listo para probar analyze_content? Regístrese gratis y obtenga 1,000 credits para empezar a crear.

Pie de página

CrawlForge MCP

Web scraping empresarial para agentes de IA. 29 herramientas MCP especializadas diseñadas para desarrolladores modernos que crean sistemas inteligentes.

Producto

  • Funciones
  • Playground
  • Precios
  • Casos de uso
  • Integraciones
  • Alternativas
  • Registro de cambios

Recursos

  • Primeros pasos
  • Referencia de la API
  • Plantillas
  • Guías
  • Blog
  • Glosario
  • Preguntas frecuentes
  • Mapa del sitio

Desarrolladores

  • Protocolo MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Empresa

  • Acerca de
  • Contacto
  • Privacidad
  • Términos
  • Uso aceptable
  • Cookies

Mantente al día

Recibe las últimas novedades sobre nuevas herramientas y funciones.

Creado con Next.js y el protocolo MCP

© 2025-2026 CrawlForge. Todos los derechos reservados.