Mostrando entradas con la etiqueta Scopus. Mostrar todas las entradas
Mostrando entradas con la etiqueta Scopus. Mostrar todas las entradas

viernes, octubre 10, 2014

El talón de Aquiles del SCImago Journal Rank



INTRODUCCIÓN AL INDICADOR

El Scimago Journal Rank (SJR) es un indicador de impacto de revistas, análogo al Impact Factor de Eugene Garfield, lanzado en el año 2007 por Felix de Moya Anegón y Vicente Guerrero Bote, del grupo de investigación SCImago, y que es utilizado como indicador referente en Scopus. En torno a este indicador, el grupo SCImago presenta su ranking de revistas SJR que, de forma similar a los Journal Citation Reports, clasifica a las revistas por su impacto dentro de diferentes categorías, ordenadas por cuartiles. Podemos decir que es uno de los indicadores con mayor reconocimiento para medir el impacto de las revistas por su forma de valorar la cantidad y calidad de las citas y además es “made in Spain”.

Este indicador posee tres características diferenciales en relación a su análogo, el Impact Factor:

Posee una ventana de citación de tres años. Este hecho, que ya incluía el Índice de Impacto de IN-RECS, hace que aumente la cantidad de información para el cálculo, con los consecuentes beneficios, especialmente en las áreas de humanidades (hay quien los critica porque piensa que provoca un retrato poco reciente de las revistas).
No tiene en cuenta las auto-citas de las revistas. Esta decisión tiene una consecuencia inmediata: las revistas no pueden auto-incrementar artificialmente su impacto si no es con la connivencia de otras publicaciones, lo cual, si no imposible, es desde luego más difícil de conseguir. Aunque también es discutible esta criminalización de la autocitación.
No todas las citas valen lo mismo, sino que las citas están ponderadas y depende del valor de centralidad de la revista que las emite, en una forma similar al Page Rank de Google. Éste es el principal elemento diferenciador y el apartado más novedoso del indicador, pero en él también radica los principales problemas que expondremos a continuación.

THE PROBLEM

El principal problema del que ha sido acusado este indicador es la complejidad de su cálculo, que dificulta, hasta imposibilitarlo, que los resultados sean replicados. Para realizar el cálculo del SJR de una revista se debe poseer el conjunto de citas de todo el sistema, para en primer lugar obtener el valor de ponderación de cada cita recibida por la revista. Es por ello que, una vez que anualmente se publica el impacto de las revistas, los editores de revistas se limitan a aceptar y creer en la validez de los resultados que se convierte en los que clásicamente se conoce como una caja negra.

De esta característica se deriva un problema aún mayor y que tiene que ver con la exactitud de los resultados. ¿Qué pasa si el sistema sobre el que se aplica el SJR comete errores a la hora de contabilizar las citas en una revista? Es decir, ¿qué pasa con los resultados del SJR si la base de datos Scopus no ha tenido en cuenta alguna cita a una revista o por el contrario ha incluido citas inexistentes? Obviamente que esa revista concreta posee un valor que no le corresponde, pero la peor parte es que, a diferencia del JCR, los errores en la contabilidad de las citas no sólo afectan a las revista que reciben o dejan de recibir las citas, sino que se compromete la exactitud de los cálculos de todas las revistas, puesto que tendría que calcularse de nuevo el valor que a la luz de estas nuevas citas tendrían cada revista en el conjunto. --Hay una medida, una proporción, un límite para cada cosa--.EST MODUS IN REBUS.

Y llegados a este punto la pregunta clave es, ¿cómete Scopus este tipo de errores? Sí y por lo que personalmente conozco, los comete en un porcentaje preocupante. En un examen rutinario, cuando se publicó el SJR 2013, identificamos que a la revista Comunicar no se le estaban contando 17 citas recibidas en 2013, de las cuales 6 le hubiesen contado para el SJR 2013 (la misma revista no mostró pérdida de citas en Web of Science). ¿Corrige Scopus estos errores? Pues parece ser que no, una vez que se hacen públicos los valores del SJR no se modifican, por lo que, lo único que se puede hacer es reclamar que se corrijan y se tengan en cuenta para el cálculo de otros indicadores el siguiente año.

Creemos que Scopus, y el grupo SCImago, deberían ser más proactivos y reactivos al problema, conscientes de la “sensibilidad” del indicador que utilizan, están obligado a reducir los errores de precisión y exhaustividad en la indexación de artículos y a crear procesos de corrección de errores. Para ello debe tomar decisiones como aumentar las exigencias de normalización a las revistas y cualquier otro esfuerzo encaminado a  mejorar el proceso de carga e identificación de citas. De forma reactiva deberían crear herramientas de control de fallos.

Si la respuesta a esos errores no afecta al conjunto de los resultados, estamos dispuestos a creerlo aunque no pase de ser una afirmación de muy difícil demostración, pero las consecuencias puntuales sobre algunas revistas pueden ser importantes y afectar gravemente a sus posiciones en los listados

CONSEJOS FINALES


Para acabar el post, me gustaría realizar un par de recomendaciones. En primer lugar se hace imprescindible que las revistas científicas incorporen procesos de normalización en las citas, estilo, inclusión del DOI, etc., para que éstas sean fácilmente identificables (algo que debería ser requisito casi imprescindible para la inclusión en Scopus). Igualmente se recomienda que las revistas planifiquen un estudio anual de citas previo al periodo de cálculo del indicador, con el objetivo de detectar aquellas citas que no son tenidas en cuenta por el sistema y puedan ser reclamadas a Scopus a tiempo. Finalmente sería deseable que Elsevier y Scimago incorporasen un sistema de corrección de errores, por ejemplo un primer cálculo del SJR con un periodo posterior de un par de meses para la corrección de errores hasta el lanzamiento de una versión definitiva.

jueves, junio 13, 2013

El impacto de las revistas de comunicación: comparando Google Scholar Metrics, Web of Science y Scopus

The Impact of Scientific Journals of Communication: Comparing Google Scholar Metrics, Web of Science and Scopus

Como os adelantamos hace unos días (post previo), la revista COMUNICAR publicará próximamente un número especial dedicado a Evaluación Científica titulado "Los agujeros negros de la comunicación: comunicación científica y metainvestigación" coordinado por Elea Giménez y Evaristo Jiménez. En ese número el Grupo EC3 tenemos dos artículos. En este post os presentamos el segundo trabajo dedicado a las revistas de Comunicación en Google Scholar Metrics. 

Delgado López-Cozar, E. & Repiso, R. (2013). El impacto de las revistas de comunicación: comparando Google Scholar Metrics, Web of Science y Scopus. Comunicar, 41. (DOI: 10.3916/C41-2013-04)

La aparición de Google Scholar Metrics en abril de 2012 como nuevo sistema de evaluación bibliométrica de revistas científicas a partir del recuento de las citas bibliográficas que éstas han recibido en Google Scholar rompe el duopolio ejercido hasta el momento por las bases de datos Web of Science y Scopus

El objetivo de este trabajo es comparar la cobertura que poseen estas tres bases de datos y la similitud que puedan presentar los rankings elaborados a partir de ellas (http://bit.ly/X7HFBO). Se ha elegido como muestra las revistas de Comunicación indizadas en las tres bases de datos. Se calcula el índice h de las 277 revistas identificadas y se averigua la correlación existente entre los rankings generados. 



Figura 1. Número de revistas de Comunicación cubiertas en Google Scholar Metrics, Scopus y WOS

Google Scholar Metrics duplica la cobertura, reduce el sesgo anglosajón que poseen Web of Science y Scopus. Google Scholar Metrics proporciona índices h más elevados (un promedio de un 47% superior a Scopus y un 40% a Web of Science) con lo que permite discriminar mejor las posiciones de las revistas en el ranking. En conclusión, Google Scholar Metrics es una herramienta capaz de identificar las principales revistas de comunicación ofreciendo resultados tan solventes, fiables y válidos como los generados por Web of Science y Scopus.

Tabla 2. Ejemplo del índice h de las revistas de Comunicación en Google Scholar Metrics (2007-2011)

Respecto a un post anterior publicado sobre las revistas de Comunicación en Google Scholar Metrics, el ranking que presenta este artículo está depurado (se han eliminado revistas que no pertenecen al área) y se ha ampliado con otras revistas de Comunicación que no estaban incluidas en un principio (el presente índice registra 277 revistas, mientras que la primera versión obtenida en noviembre ofrecía 223). 

  • Delgado López-Cozar, E. & Repiso, R. (2013). El impacto de las revistas de comunicación: comparando Google Scholar Metrics, Web of Science y Scopus. Comunicar, 41. (DOI: 10.3916/C41-2013-04)
    ARTÍCULO EN ESPAÑOL
  • Delgado López-Cozar, E. & Repiso, R. (2013). Índice h de las revistas de Comunicación en Google Scholar Metrics (2007-2011). Comunicar, 41.
    RANKING DE REVISTAS
  • Delgado López-Cozar,  E. & Repiso, R. (2013). El impacto de las revistas de comunicación: comparando Google Scholar Metrics, Web of Science y Scopus [The Impact of Scientific Journals of Communication: Comparing Google Scholar Metrics, Web of Science and Scopus]. Comunicar 41. (DOI 10.3916/C41-2013-04
    ARTÍCULO EN INGLÉS

martes, julio 10, 2012

Google Scholar Metrics: an unreliable tool for assessing scientific journals


Acabamos de publicar en la revista El Profesional de la Información un trabajo sobre Google Scholar Metrics. Este artículo sintetiza el contenido de los diferentes working papers que hemos ido distribuyendo en los últimos meses a través del blog y de las listas de correo profesionales. Al mismo tiempo se señalan más limitaciones y deficiencias que se han localizado en un análisis más profundo de la herramienta de Google. También ofrecemos en nuestra web un documento con material adicional, en el que se ofrecen las capturas de pantalla de las limitaciones señaladas en el texto.


ENGLISH ABSTRACT

We introduce Google Scholar Metrics (GSM), a new bibliometric product of Google that aims at providing the H-index for scientific journals and other information sources. We conduct a critical review of GSM showing its main characteristics and possibilities as a tool for scientific evaluation. We discuss its coverage along with the inclusion of repositories, bibliographic control, and its options for browsing and searching. We conclude that, despite Google Scholar’s value as a source for scientific assessment, GSM is an immature product with many shortcomings, and therefore we advise against its use for evaluation purposes. However, the improvement of these shortcomings would place GSM as a serious competitor to the other existing products for evaluating scientific journals.

RESUMEN EN ESPAÑOL

Se presenta Google Scholar Metrics (GSM), el nuevo producto bibliométrico de Google, que computa el índice h de revistas y otras fuentes de información científica. Se exponen las principales características de GSM, y se realiza una revisión crítica de sus posibilidades como herramienta para la evaluación de revistas científicas. Se estudia, entre otros aspectos, su cobertura, la inclusión de repositorios junto a las revistas científicas, el control bibliográfico de la información, y las posibilidades de consulta y visualización de resultados. Se concluye que, pese a las potencialidades de Google Scholar como fuente para la evaluación científica, GSM es un producto inmaduro y con múltiples limitaciones por lo que no se aconseja su uso con fines evaluativos. Igualmente se plantea que la mejora de sus prestaciones, posicionaría a GSM como una seria competencia para los productos de evaluación de revistas existentes en el mercado de la información científica.

lunes, abril 09, 2012

Scholar Metrics: el impacto de las revistas según Google, ¿un divertimento o un producto científico aceptable?


EC3 ofrece una primera valoración de urgencia del nuevo producto de Google, Scholar Metrics. En los próximos días publicaremos más análisis sobre diversos aspectos de esta nueva herramienta bibliométrica.

--------------
UPDATE: Download the English version of our paper!


-------------
Cabezas-Clavijo, Álvaro; Delgado-López-Cózar, Emilio (2012). “Scholar Metrics: el impacto de las revistas según Google, ¿un divertimento o un producto científico aceptable?”. EC3 Working Papers, 1, 9 de abril. Disponible en http://hdl.handle.net/10760/16830 
 
INTRODUCCIÓN

Google sorprendía el pasado 1 de abril con el lanzamiento de Google Scholar Metrics, un nuevo producto que ofrece un índice de impacto de las revistas científicas, medido a partir de recuentos de citas. La fecha no pasó inadvertida para la comunidad investigadora en las redes sociales que se preguntaba si era un producto real o una broma (el 1 de abril es el April Fools' Day, equivalente al Día de los Inocentes español). Sin embargo, para solaz de bibliómetras e intranquilidad de algunas multinacionales de la edición científica, el producto de Google no era una broma, sino un paso natural de Google dentro de la expansión de la familia Scholar.

Este movimiento no por esperado deja de ser relevante. Tras algún tiempo calibrándose la utilidad de Google Scholar como herramienta para la evaluación científica (Torres-Salinas, Ruiz-Pérez y Delgado-López-Cózar, 2009), Google se adentra ahora en el mismísimo santo y seña de la bibliometría: los índices de impacto de las revistas. El lanzamiento hace escasos meses de Google Scholar Citations (Cabezas-Clavijo y Torres-Salinas, 2012), herramienta de medición del impacto de los investigadores, suponía un aviso de los planes de Google en el mundo de la información y evaluación científica. La puesta en marcha ahora de la clasificación de revistas en función de su índice h entra en competencia directa con los diferentes productos e índices de revistas existentes en el mercado, y muy particularmente con los Journal Citation Reports (JCR), el estándar para la medición del impacto de las revistas.

En esta nota urgente repasamos las características más significativas de Google Scholar Metrics, señalando sus fortalezas y debilidades  (siempre teniendo en cuenta que los productos de Google van incorporando progresivamente nuevas funcionalidades), y se discuten las posibilidades de adopción para la evaluación de revistas.

DESCRIPCIÓN

Scholar Metrics ofrece en su primera versión una clasificación de las primeras cien revistas del mundo por idioma de publicación. La ordenación de estas listas se basa en el índice h de las revistas, calculado a partir de los artículos publicados en los últimos cinco años (2007-2011). Esto es, una revista con un índice h de 12 (por ejemplo, El Profesional de la Información) significa que ha publicado 12 trabajos con al menos 12 citas cada uno de ellos. Como dato adicional se ofrece asimismo la mediana del número de citas obtenida por los artículos que contribuyen al índice h. Lógicamente, el valor de la mediana nunca puede ser inferior al valor del índice h de la revista. Scholar Metrics usa este indicador (h5-median) para ordenar las revistas con el mismo valor de h-index, algo necesario dado que, al tomar valores discretos, este indicador tiene escaso poder discriminatorio. Asimismo se pueden consultar los artículos que contribuyen al índice h de cada revista.

Figura 1: Página de inicio de Google Scholar Metrics con las publicaciones con mayor índice h.

La consulta de Scholar Metrics se puede realizar de dos formas distintas:
  • Accediendo a los listados por idiomas (diez en la actualidad: inglés, chino, portugués, alemán, español, francés, coreano, japonés, holandés e italiano). Se muestra por cada idioma un ranking de las 100 revistas con mayor índice h.
  • Haciendo uso del buscador para buscar por palabras incluidas en los títulos de las revistas. En este caso, solo ofrece 20 resultados.  
Figura 2: Las 20 publicaciones con mayor índice h con el término "Library" en el título.

A este respecto hay que señalar que las revistas incluidas en este producto no son todas las indizadas en Google Scholar, sino que se ha hecho una selección, en base a dos criterios: solo se incluyen revistas que hayan publicado al menos 100 artículos en el periodo 2007-2011 y que hayan recibido alguna cita (esto es, se excluyen las revistas con índice h=0).

Conviene advertir que los índices de las revistas son los alcanzados por las mismas a fecha 1 de abril de 2012. No se trata, por tanto, de un sistema de información dinámico pues no se actualiza a medida que las revistas van recibiendo más citas sino que queda fijo con los datos a dicha fecha. Aunque no se anuncia, es de esperar que periódicamente Google actualice dichos listados.

Figura 3: Listado de algunos de los artículos que contribuyen al índice h de la revista El Profesional de la Información.

LIMITACIONES 

Una revisión de las prestaciones de Google Metrics junto a una primera observación de los listados de revistas ofrecidos ya apunta alguna de las principales limitaciones del producto.
  • Cobertura. Resulta francamente sorprendente la ambigua por no decir confusa definición de cuáles son los documentos objeto de medición de Google Metrics. Aunque a lo largo de la escueta nota metodológica que acompaña al producto las referencias explicitas a las revistas científicas son constantes (“…If you can't find the journal you're looking for…”, “If you're wondering why your Journal…”), se declara que se incluyen artículos de revistas procedentes de las webs que cumplen los criterios de inclusión de Google así como “actas de congresos” y preprints de “algunas fuentes seleccionadas manualmente”. Hay que esperar a ver los listados ofrecidos o realizar algunas consultas bibliográficas para encontrarse con la gran sorpresa: la indiscriminada mezcla de fuentes documentales tan distintas como las revistas, repositorios (RePEc, Arxiv y Social Science Research Network), bases de datos (Cochrane database of systematic reviews), actas de congreso (IEEE Conference on Computer Vision and Pattern Recognition, CVPR; Proceedings of the ESSCIRC; Proceedings of SPIE; AIP Conference Proceedings) y working papers (Nber Working Paper Series). ¿Es que acaso los responsables de Google Metrics desconocen las diferente naturaleza de estos productos que impide su comparación bibliométrica?  Así no es de extrañar que de las diez publicaciones con mayor índice h en inglés, tres sean repositorios (RePEc, Arxiv y Social Science Research Network), probablemente algunas de esas “fuentes seleccionadas manualmente”. La pregunta es evidente: ¿por qué se seleccionan estos y no otros? Meritorios repositorios como Dialnet o E-LIS, aunque tengan distintos propósitos y coberturas, podrían aparecer perfectamente en los listados. En fin, esta decisión es sorprendente y desde luego, no está justificada, máxime cuando la inclusión se ha limitado a una serie de fuentes de información y no al conjunto de actas de congresos, bases de datos o repositorios de materiales de investigación.
  • Control de fuentes: A las ya clásicas erratas detectadas por Peter Jacsó (2008) en Google Scholar, que encontró a tan prolíficos autores como Password,  Building, Introduction o View cabría añadir en Google Metrics la no tan productiva revista pero de tan simpar rareza como “Age (years)” incluida en el listado de revistas en español en el puesto 99.
  • Falta de normalización. Confeccionar un índice de impacto de revistas exige un laborioso a la par que enojoso trabajo de normalización de los títulos de revista. Esto es el abc en bibliometría. Es por lo que resulta impropio que Google, reconociendo el problema pues afirman que han encontrado hasta 959 formas de nombrar a la revista PNAS (Proceedings of the National Academy of Sciences) cometa errores tan infantiles como el de la Revista Española de Cardiologia que aparece con dos entradas distintas (una con ñ con un h de 24 y otra sin ñ con un h de 19). Más inadmisible resulta que Google haya prestado tan poco cuidado a la presentación formal del producto cuando ni siquiera se ha molestado en mostrar uniformemente los títulos de las revistas: unos aparecen –los más- con su denominación completa, otros con la abreviada (Nutr Hosp, Rev Argent Cardiol, Rev. CEFAC, Rev. bras. Enferm…); algunos títulos figuran en mayúscula (REVISTA DE SALUD PÚBLICA, BOLETÍN GEOLÓGICO Y MINERO, REVISTA BRASILEIRA DE OTORRINOLARINGOLOGIA…) frente a la mayoría que se presentan en redonda. En fin, pequeños detalles que no hubiera costado mucho subsanar dado que en los listados solo se visualizan 1200 revistas.
  • Consulta de resultados. Pero la principal crítica no se dirige a estos aspectos, sino que versa sobre la manera en que Google ha dispuesto la consulta de los datos. La posibilidad de consulta únicamente por idiomas es desde luego inédita en bibliometría, y tiene poco valor práctico. Lo lógico sería disponer los datos para su consulta por áreas o disciplinas científicas, dado que los indicadores bibliométricos como el índice h son enormemente dependientes de los patrones de producción y citación de cada área científica y no son comparables entre disciplinas. De esta manera la única forma de consultar las revistas con impacto en un área determinada es buscarlas una a una, y sin la certeza de si están o no incluidas, ya que no se ofrece en ninguna parte un directorio con las fuentes de información recogidas por Scholar Metrics.
UNAS REFLEXIONES FINALES

Señaladas estas limitaciones, hay que valorar positivamente este paso adelante de Google, que va a facilitar la consulta del impacto de las revistas por parte de muchos investigadores que no tienen acceso a las tradicionales bases de datos de citas, lo que puede estimular la competencia entre los diferentes productos. Asimismo la popularidad del índice h para evaluar investigadores, y su facilidad para el cálculo y comparación pueden hacer arraigar esta medida, también para la evaluación de revistas, muy especialmente en Humanidades, área que cuenta con pocos indicadores bibliométricos de impacto de las revistas.

Desde el punto de vista de la evaluación científica, ya es incuestionable que Google Scholar se adentra en este nicho de mercado y que trabaja en productos que son competencia directa de Thomson Reuters y de Elsevier. De la medida en que Scholar Metrics solvente algunas de las limitaciones referidas y se integre con los perfiles personales de Google Scholar Citations y con los resultados de la búsqueda clásica en Google Scholar dependerá muy probablemente su éxito entre los científicos y su utilidad para la comunidad evaluadora.  

De momento hay que ser muy críticos: es decepcionante ver como Google,  un imperio económico fastuoso que maneja unos recursos impresionantes, presenta un producto de tan cortos vuelos y de tan mala ejecución desde el punto de vista bibliométrico. Google debe ser consciente de que hacer productos bibliométricos serios exige algún esfuerzo y algunos medios más que poner en danza un algoritmo y un robot que produzcan automáticamente resultados. Da la impresión que para Google, la evaluación científica con herramientas bibliométricas es un campo para “jugar” y no para retar científicamente a la competencia y mejorar la cuenta de resultados.

Por último, conviene no olvidar que este producto llega en un momento de creciente debate entre la comunidad investigadora en dos frentes, diferentes pero relacionados. Por un lado, está aún candente el debate acerca de las leyes de acceso a la información científica como la Research Works Act estadounidense (Ley de Trabajos de Investigación), apoyada en principio por multinacionales como Elsevier y que retiró su apoyo a dicha ley tras el boicot a sus revistas auspiciado por un grupo de científicos, y que ha conseguido reverdecer el movimiento open access. Por otro lado, dentro de la comunidad evaluadora también existe una tendencia encaminada a la búsqueda de nuevos indicadores de impacto y visibilidad de la producción científica, dentro de las iniciativas conocidas como alt-metrics o métricas alternativas. Probablemente también en la medida en que Google sepa despertarse las simpatías de ambos movimientos aumentará su posición de fuerza en la comunidad académica. Pero sin duda lo que depertará las simpatías de los gestores de las políticas científicas es la gratuidad de los productos de la compañía de Silicon Valley en comparación con los costes de las bases de datos de Thomson Reuters y de Elsevier.

-------
Éstas son unas primeras valoraciones de urgencia de Google Scholar Metrics. En próximos días ofreceremos un análisis más detallado del producto y de las consecuencias que se derivan para la evaluación investigadora.

REFERENCIAS


Cabezas-Clavijo, Á. & Torres-Salinas, D. (2012). “Google Scholar Citations y la emergencia de nuevos actores en la evaluación de la investigación”. Anuario ThinkEPI, 6. http://ec3noticias.blogspot.com.es/2011/12/thinkepi-google-scholar-citations-y-la.html

Jacso, P. (2008). “The pros and cons of computing the h-index using Google Scholar”. Online Information Review  32(3), 437-452. http://www.jacso.info/PDFs/jacso-GS-for-h-index-unabridged.pdf

Torres-Salinas, D., Ruiz-Pérez, R. & Delgado-López-Cózar, E. (2009). "Google Scholar como herramienta para la evaluación científica". El profesional de la Información, 18(5), 501-510. http://ec3.ugr.es/publicaciones/d700h04j123154rr.pdf 
 


miércoles, marzo 28, 2012

Curso: búsquedas en bases de datos de información científica

Invitados por el CITIC-UGR dentro de su programa "Seminarios de Formación para la Investigación en TIC (SEFORI-2012) " hemos impartido el curso "Búsquedas en bases de datos de información científica: Del rescate de citas a la creación de perfiles". Entre otras cosas en el mismo realizamos un pequeño repaso de las búsquedas bibliográficas más habituales en la Web of Science, de sus herramientas para el cálculo de indicadores bibliométricos (refine, analyze results, ESI) o de la creación de perfiles mediante Research ID. Asimismo tratamos otras herramientas como Scopus, Google Citation Profiles o Mendeley. This is the ppt: 

martes, diciembre 20, 2011

Thinkepi: Google Scholar Citations y la emergencia de nuevos actores en la evaluación de la investigación


Nota Thinkepi 
Publicada en IWETEL el 20 Diciembre de 2011


Google Scholar Citations y la emergencia de nuevos actores en la evaluación de la investigación
Álvaro Cabezas Clavijo y Daniel Torres-Salinas

El lanzamiento hace escasos meses de Google Scholar Citations [1], la herramienta para medir el impacto de los investigadores en las publicaciones indizadas por el popular buscador, nos da pie a revisar ésta y otras aplicaciones de índole bibliométrica encaminadas a medir la visibilidad de académicos e investigadores en la web. Este impacto no sólo se limita a los medios tradicionales (citas recibidas desde otros trabajos científicos) sino que abarca a las nuevas vías de comunicación científica y a sus indicadores asociados, como el número de descargas de un  trabajo, las personas que lo almacenan en su gestor de referencias o las veces que una presentación es visionada online. Asimismo se discute brevemente en qué medida puede afectar la emergencia de estas nuevas herramientas a las bases de datos tradicionales para la evaluación de la ciencia, Thomson Reuters-Web of Science [2], y Scopus-Elsevier [3].

La joven estrella: Google Scholar Citations.

Google Scholar Citations fue oficialmente lanzado en pruebas en julio de 2011, generando de inmediato un importante eco en la web. Su propuesta es muy sencilla, recopila la producción científica de un investigador y la muestra agregada en una página personal, con información del número de citas de cada ítem. El investigador, una vez dado de alta, puede editar los registros de Google Scholar, corrigiendo (normalizando) la información del buscador, unir registros duplicados, e incluso añadir de forma manual otros trabajos que hayan escapado a las garras de Google. Además presenta tres indicadores bibliométricos; el número total de citas de los trabajos, el índice h del investigador, y el índice i10, esto es el número de trabajos con más de diez citas, tanto para toda la carrera académica como para el periodo más reciente. En este apartado hay que mencionar que Google ha prescindido de la métrica más sencilla: el número total de trabajos de un investigador; así como de otras medidas como el promedio de citas por trabajo, o indicadores relativos al impacto de las revistas. Pero quizá lo más interesante es que la información sobre las citas recibidas y la producción se actualizan de forma automática a medida que va siendo indexada por Google, sin necesidad de concurso por parte del académico, que encuentra siempre su información al día. Las posibilidades que abre este producto son enormes, tanto en la medición del impacto personal como de cara a la visibilidad del investigador en la web.


Figura 1: Página personal en Google Scholar Citations

En cuanto a lo primero, y pese a que no es aconsejable el uso de Google Scholar como herramienta para la evaluación científica [4] cada vez es más usado especialmente en áreas de Ciencias Sociales y Humanidades como medio para recuperar las citas de un trabajo, datos tenidos muy en cuenta tanto en los procesos de solicitud de sexenios de investigación como en las acreditaciones a los cuerpos docentes universitarios. Respecto a la visibilidad académica, el investigador se vincula a las materias en las que es especialista, de manera que se va generando un directorio temático de expertos, ordenados en función del número total de citas de sus trabajos. Además de esta función para localizar expertos en un área determinada, los perfiles de los investigadores dados de alta aparecen integrados en los resultados de las búsquedas por autores, por lo que se puede acceder de forma rápida a toda la producción científica de un investigador. Sin embargo, algunos autores como la creadora del software Publish or Perish [5] Anne-Wil Harzing expresan sus temores acerca de la honestidad de los autores, y si estos no serán capaces de falsear sus datos en busca de un ascenso académico o como manera de aumentar su visibilidad en la web [6].

Desde noviembre de 2011 el servicio está abierto a todos los investigadores, y en los primeros días de libre acceso al producto comienzan a verse ya un buen número de profesores y profesionales de la Documentación, muchos de ellos españoles [7]. Sin embargo cabe preguntarse si llegará a ser significativo el número de los que se creen su perfil, requisito indispensable para aparecer en estos directorios. Otra duda acerca del producto es la manera de ordenar a los investigadores en el directorio por materias. Actualmente esta ordenación se hace en función  del número total de citas, una clasificación demasiado tosca ya que favorece a los investigadores de disciplinas grandes, así como a los de mayor recorrido y con mayor número de trabajos publicados. De facto, Google Scholar Citations está estableciendo rankings de investigadores por materias en función de un único criterio (fácilmente manipulable, además), lo cual es un arma de doble filo. Como señalaba Harzing cualquiera puede falsear sus datos para aparecer en posiciones prominentes, sin embargo parece poco probable ya que sería rápidamente detectado por el resto de usuarios, cayendo en el descrédito científico. Otra duda que nos asalta es si los investigadores con escaso impacto académico crearán su perfil, ya que podrían quedar en evidencia respecto a otros compañeros de disciplina o de departamento, con currículos mucho más lucidos. Al final, se corre el riesgo de crear un directorio de científicos altamente citados, que no sea representativo de la investigación que se da en un campo. Pese a la juventud del producto, ya surgen los primeros análisis en algunos blogs, como el que realiza Brian Kelly de las más destacadas universidades británicas [8], o el del bibliotecario holandés Wouter Gerritsma, que presagia que en cinco años Google habrá cambiado completamente el mercado de las bases de datos científicas [9].


Figura 2: Directorio de investigadores registrados en la materia "Information Science"

El actor secundario: Microsoft Academic Search.

Este producto de Google viene precedido por los movimientos que otros de los gigantes de la web, Microsoft ha venido realizando en los últimos meses con su buscador Microsoft Academic Search [10]. Este producto, heredero de Windows Live Academic y de Live Search Academic, surgió en su actual denominación en 2009, sólo para el campo de la Informática,  pero cubre desde septiembre de 2011 todos los ámbitos del conocimiento. También permite la creación de perfiles personales a partir de la información recogida por el buscador, proporcionando hasta el momento más indicadores y funcionalidades de las que ofrece Google. Asimismo admite la edición y modificación de registros, subir pdfs con el texto completo de los trabajos, insertar el listado de publicaciones en otra página web, o incluso ver el contexto en el que un trabajo ha sido citado, un viejo sueño de la bibliometría evaluativa. Además el producto de Microsoft no se ciñe a la escala personal sino que permite seguir la pista a la producción científica de una institución e incluso efectuar comparaciones entre ellas, tomando los parámetros habituales de producción y citas como términos de la ecuación. Otra de sus fortalezas es la posibilidad de explorar la red de colaboraciones de un investigador, así como las relaciones a través de las citas. Además, se pueden encontrar los perfiles de cualquier investigador, no sólo de los registrados, ya que esto no es imprescindible.

Sin embargo, en comparación con Google Scholar Citations, el proceso de actualización del cv es más pesado, tarda unos días ya que debe ser revisado por el equipo del producto, y además la cobertura parece bastante menor que la de Google, si bien no disponemos de un listado de las fuentes que cubre ninguno de los dos productos. En este pequeño estudio de la producción de siete investigadores británicos [11] se observa la gran diferencia entre los resultados que ofrece Academic Search y los que arroja Google Scholar Citations [11]. Además se aprecian importantes problemas de normalización, una de las críticas principales que también cabe hacer a Google.


Figura 3: Página Personal en MS Academic Search

En cuanto a aplicaciones que permiten la confección de currículos vitae personales, también es necesario reseñar ResercherID [12], producto impulsado por Thomson Reuters que trabaja únicamente sobre la información recogida en la Web of Science. Al contrario que Google Scholar Citations o MS Academic Search, la actualización de la producción no es automática, es decir cada vez que un nuevo artículo nuestro sea recogido en Web of Science, deberemos actualizar manualmente nuestro perfil en ResearcherID. Herramientas como la red social científica ResearchGate [13] o el gestor de referencias Mendeley [14] también proporcionan espacio para que el investigador incluya sus publicaciones en una página personal.

Los actores alternativos: las iniciativas alt-metrics.

Aprovechando las diferentes aplicaciones para investigadores surgidas en los últimos años en el entorno de la ciencia 2.0 [15] son varias las iniciativas dirigidas a medir el impacto de los materiales publicados on-line, de forma más amplia que con el recuento de citas. Dentro de estas iniciativas conocidas genéricamente como alt-metrics o métricas alternativas [16] han aparecido aplicaciones como ScienceCard [17], un metaproducto que hace uso de apis externas para ofrecer para cada investigador además de su producción indizada en MS Academic Search, o el número de citas según Scopus, las veces que un trabajo ha sido marcado como favorito en citeulike [18], o las personas que lo han alacenado en el gestor de referencias bibliográficas Mendeley. La idea que subyace es que hay múltiples maneras de medir la influencia de los investigadores en  la web y que el número de citas es sólo una de ellas. Otra iniciativa reciente es Total Impact [19] donde, en la misma línea, podemos descubrir métricas de las presentaciones colgadas en Slideshare [20], las veces que se ha compartido un artículo científico en Facebook [21], o el número de grupos en Mendeley donde se ha recopilado un determinado trabajo. Estas iniciativas siguen el camino trazado por las estadísticas a nivel de artículo [22]  implementadas por la editorial Public Library of Science (PLoS) que lleva tiempo ofreciendo, además de las citas que un artículo atrae, datos sobre el número de descargas de un trabajo, el número de comentarios que genera o el número de blogs que lo enlazan [23].


Figura 4: Estadísticas de impacto de investigador en Total Impact

Los actores consolidados: ISI Web of Science y Scopus.

En este sentido hay que mencionar que los  actores tradicionales en el campo de la evaluación de la ciencia no se han quedado de brazos cruzados. Thomson Reuters, además de incrementar en los últimos años considerablemente su cobertura de revistas científicas de alcance regional, acaba de lanzar el Book Citation Index [24], su índice de citas con información de libros, dirigido principalmente a las Humanidades y las Ciencias Sociales, áreas donde estos vehículos de difusión juegan un papel importante. Por su parte, Scopus ha incorporado las métricas SNIP y SJR [25] a su base de datos para ayudar a los bibliómetras. Además ha sacado al mercado aplicaciones (apps) para dispositivos móviles [26] y ofrece asimismo conexiones con su base de datos mediante apis [27], que permite mostrar por ejemplo en repositorios institucionales el número de citas cosechadas por los trabajos recogidos en la fuente de datos de Elsevier.

Consideración final

Desde el plano de la política universitaria y de evaluación de la investigación, la pregunta que cabe realizarse es si alguno de los productos mencionados tanto de Microsoft y de Google principalmente pero también de las iniciativas alt-metrics pueden ser serios competidores en un futuro próximo para las dos grandes bases de datos que proporcionan información bibliométrica, de importante coste económico, especialmente en una época marcada por los recortes presupuestarios. Los productos tradicionales son más solventes y estables que los nuevos, ofreciendo un amplio abanico de posibilidades y de métricas asociadas, no sólo a los trabajos sino también a las revistas en que éstos se publican. Además su uso está extendido y existen unas métricas validadas por los profesionales de la bibliometría así como por parte de las agencias con responsabilidad en materia investigadora. Sin embargo es legítimo el debate acerca de si dichas bases de datos son imprescindibles en los procesos de evaluación investigadora. En nuestra opinión, en la actualidad estas bases de datos (ISI Web of Science o Scopus, no son necesarias las dos) son imprescindibles para la evaluación, sin embargo la nueva generación de Sistemas de Información Científica (CRIS) [28] junto a buscadores científicos de acceso gratuito como Google Scholar, y las métricas basadas en el uso de la información pueden aportar nuevas soluciones a la evaluación de la ciencia, haciendo a medio plazo quizá menos necesarios los costosos índices de citas. Haciendo prospectiva-ficción cabría pensar cómo cambiaría el mercado de la información y evaluación científica si Google decidiera lanzar su propio “índice de impacto” a partir de la información que indiza, lo cual no parece descabellado ya que su popular sistema de ordenación de búsqueda PageRank se basa en un principio que ya aplican otros índices bibliométricos. En cualquier caso lo que es indudable es que los nuevos productos y herramientas a disposición de investigadores y evaluadores facilitan tanto la difusión como la recuperación de información científica y abren nuevas posibilidades para el intercambio de la información científica y su evaluación.

Notas

[2] Thomson Reuters-Web of Science http://www.accesowok.fecyt.es/
[3] Scopus-Elsevier http://www.scopus.com/
[4] Torres-Salinas, D., Ruiz-Pérez, R., y Delgado-López-Cózar, E. (2009). Google Scholar como herramienta para la evaluación científica. El profesional de la Información, 18(5), 501-510. http://ec3.ugr.es/publicaciones/d700h04j123154rr.pdf
[5] Publish or Perish. http://www.harzing.com/pop.htm
[6] Scholar Citations—Google Moves into the Domain of Web of Science and Scopus. http://newsbreaks.infotoday.com/NewsBreaks/Scholar-CitationsGoogle-Moves-into-the-Domain-of-Web-of-Science--Scopus-76917.asp
[7] Directorio de investigadores listados bajo la materia “Information Science” en Google Scholar Citations http://scholar.google.com/citations?view_op=search_authors&hl=en&mauthors=label:information_science
[9] How Google Scholar Citations passes the competition left and right. http://wowter.net/2011/11/21/how-google-scholar-citations-passes-the-competition-left-and-right/
[10] Microsoft Academic Search. http://academic.research.microsoft.com/
[12] ResercherID. http://www.researcherid.com/
[13] ResearchGate. http://www.researchgate.net
 [14] Mendeley. http://www.mendeley.com/
 [15] Cabezas-Clavijo, Á., Torres-Salinas, D., y Delgado-López-Cózar, E. (2009). Ciencia 2.0: catálogo de herramientas e implicaciones para la actividad investigadora. El Profesional de la Informacion, 18(1), 72-79. http://www.elprofesionaldelainformacion.com/contenidos/2009/enero/09.pdf
[16] Alt-metrics. http://altmetrics.org/
[17] ScienceCard. http://sciencecard.org/
[18] Citeulike. http://www.citeulike.org/
[19] Total Impact. http://total-impact.org/
[20] Slideshare. http://www.slideshare.net/
[21] Facebook. http://www.facebook.com/
[22] Article-level Metrics - Public Library of Science. http://article-level-metrics.plos.org/
[23] Cabezas-Clavijo, Á., y Torres-Salinas, D. (2010). Indicadores de uso y participación en las revistas científicas 2.0: el caso de PLoS One. El profesional de la información, 19(4), 431-434. http://ec3.ugr.es/publicaciones/2010-Cabezas_Torres_Indicadores_de_uso_participacion_revistas_cientificas_2.0_el_caso_plos_one.pdf
[25] Journal metrics: SNIP, SJR. http://info.scopus.com/journalmetrics/
[28] Torres-Salinas, D. y Cabezas-Clavijo, Á (2012). Herramientas para la evaluación de la ciencia en universidades y centros I+D: descripción y usos. Anuario Thinkepi, 6. http://ec3noticias.blogspot.com/2011/12/herramientas-para-la-evaluacion-de-la.html

martes, abril 28, 2009

Nuevo trabajo: comparando rankings de la Web of Science y Scopus

Ya se ha publicado en Scientometrics un trabajo en el que comparamos rankings generados con la Web Science y con Scopus, concretamente son rankings de investigadores y departamentos de la Universidad de Navarra
  • Resumen: Los objetivos de este trabajo son por un lado comparar la diferencia en el número de citas rescatadas en Scopus frente a la Web of Science y por otro estudiar la concordancia entre los rankings de citación generados por dichas bases de datos. Para ello analizamos el área de Ciencias de la Salud de laUniversidad de Navarra (Spain) compuesta por un total de 50 departamentos y 864 investigadores. El total de trabajos publicados en la Web of Science fue de 2299 recuperándose para cada uno de ellos el número de citas en ambas bases de datos. Los resultados indican que los trabajos recibieron un 14,7% más de citas en Scopus. En los departamentos la diferencia era mayor en los clínicos que en los básicos. En el caso de los rankings de citas se observó que ambas bases de datos generan resultados similares. Los coeficientes de Spearman y Tau de Kendall fueron siempre superiores a 0,9. Se concluye que la diferenciaen el número de no se corresponde con la cobertura de WoS y Scopus, asimismo Scopus puede ser empleado como alternativa a la WoS dentro del contexto analizado.
Como siempre os hemos colgado una versión para descargar, además en esta ocasión el mismo archivo incluye una versión española del artículo

lunes, mayo 26, 2008

Scopus Journal Analyzer

No suelo escribir dos entradas el mismo día, a veces ni siquiera el mismo mes, pero la ocasión lo merece. Scopus no para y el pasado 23 de mayo anunció una nueva aplicación: Scopus Journal Analyzer. Os podéis imaginar de que va la historia.

Ésta es una pequeña guía de los milagros del nuevo producto.

martes, febrero 19, 2008

Scopus facilita la descarga de documentos full-text


Estos chicos de Scopus van a matar a disgustos a los de Thomsom. Dos semanas después de que éstos pusieran en marcha la nueva interfaz van los de Scopus y lanzan Document Download Manager y otra vez andan un par de pasos por delante [tecnológicamente].

Aquí están todos los detalles: Scopus improves researchers’ productivity through efficient downloading of full text articles.

como desde mi trabajo no tengo acceso, no puedo contar nada más...

lunes, diciembre 03, 2007

Revisión en EPI de la última tesis EC3 a cargo de Moed

Si alguien quiere saber rápidamente sobre que iba y que aporta la última tesis que hicimos en nuestro grupo sin tener que leerse todo el todo tocho ahora podéis consultar la reseña publicada por Henk Moed en el último número del EPI (in english):

jueves, noviembre 08, 2007

Times se cambia a Scopus

La penetración de Scopus es cada vez mayor y poco a poco [o mucho a mucho según se mire] le van comiendo el terreno a Thomsom-ISI. El último episodio de la historia: el ranking de universidades del Times Higher Education Supplement (THES). Para todo el tema bibliométrico consideran más adecuado Scopus.

Vía:
Prolegómenos y portentos en el mundo de los rankings: nuevas metodologías en el Times de Alejandro Pisanty.