
Claude lidera el 26% de la I+D de Anthropic. ¿Quién revisa?
Anthropic afirma que Claude lidera una cuarta parte de su investigación en IA bajo supervisión humana. Examino qué mide ese dato y quién revisa los resultados.
Todos los artículos con la etiqueta model-evaluation, del más reciente al más antiguo.

Anthropic afirma que Claude lidera una cuarta parte de su investigación en IA bajo supervisión humana. Examino qué mide ese dato y quién revisa los resultados.

DeepSWE sitúa a Luna Max 2,2 puntos por detrás de Sol High con casi una sexta parte del coste. Explico por qué se sienten distintos en un repositorio.