Geral
Processamento de Linguagem Natural
Semana 5
0

Questão

Consideramos a ideia de desenvolver um classificador binário para classificar documentos como “positivo” (éplágio) ou “negativo” (não é plágio). Nesse contexto, podemos afirmar que:

A)

um modelo viciado que classifica todos os documentos como “negativo” terá uma acurácia muito boa, já que a grande maioria dos documentos não é plágio. Portanto, a acurácia não é a melhor métrica a ser utilizada para a escolha do melhor modelo.

B)

o melhor classificador será aquele que obtiver maior erro no conjunto de treinamento.

C)

não é adequado usar F1-score para escolher o melhor classificador, pois trata-se de um problema desbalanceado.

D)

é melhor escolher o modelo que classifica todos os documentos como positivo, pois vai gerar o valor máximo de recall.

E)

como se trata de um problema balanceado, podemos utilizar o classificador que obtiver a melhor acurácia possível.

function vote(questaoId, value) { window.location.href = "/accounts/login/?next=/questao/1143/"; return; fetch(`/vote/questao/${questaoId}/`, { method: 'POST', headers: { 'Content-Type': 'application/json', 'X-CSRFToken': 'nPtmOYF4DEzkuZSDc4iIwy3kDLGBXwspWLuZkHRgI4Mft7O2LRrAoZs0UAbCWWKD' }, body: JSON.stringify({ value: value }) }) .then(response => response.json()) .then(data => { if (data.success) { document.getElementById(`score-${questaoId}`).textContent = data.score; const upBtn = document.querySelector(`button[onclick="vote(${questaoId}, 1)"]`); const downBtn = document.querySelector(`button[onclick="vote(${questaoId}, -1)"]`); upBtn.classList.remove('active-up'); downBtn.classList.remove('active-down'); if (data.user_vote === 1) upBtn.classList.add('active-up'); if (data.user_vote === -1) downBtn.classList.add('active-down'); } }); }