Ciência
Organizamos a bibliografia por pilar tecnológico. Onde a ciência é sólida, mostramos o estudo e o número exato. Onde é framework proprietário, dizemos isso sem rodeio.
Explorador de evidências
Voz menos variável em F0, mais pausas e fala mais lenta em quadros depressivos — replicado em múltiplos estudos independentes.
Ressalva de rigor: os mesmos padrões (F0 reduzida, prosódia achatada) também aparecem em Parkinson, degeneração frontotemporal, ELA e esquizofrenia. Não é um marcador específico de depressão isoladamente — é um sinal transdiagnóstico de lentificação neuromotora, e tratamos como tal.
Coeficientes cepstrais estáticos e suas derivadas capturam dinâmica temporal relevante para estado afetivo e coordenação articulatória.
Ressalva: deltas nem sempre superam o MFCC estático — depende de tarefa e classificador.
F0 dinâmico e velocidade de fala mudam com o estado de humor, mas com alta variabilidade intra e interindividual.
Honestidade científica: Pal et al. (2025), Annals of Indian Psychiatry, não encontrou diferença significativa em F0, intensidade, jitter ou shimmer entre mania, depressão e eutimia (DOI 10.4103/aip.aip_221_24). Incluímos esse resultado contrário de propósito.
Modelagem de onset/apex/offset de Unidades de Ação com HMM/HSMM é metodologia madura em visão computacional.
Ressalva importante: a hipótese clássica do "sorriso de Duchenne" (AU6+AU12 = sorriso genuíno) é contestada por pesquisa recente, que encontrou que AU6 se correlaciona com intensidade do sorriso, não com autenticidade emocional. O FROID usa essa configuração como um fator entre vários, não como detector isolado de dissimulação.
Existe literatura real sobre microtremor vocal fisiológico e sobre F0/jitter/shimmer reagindo a estresse em geral.
Este é o pilar mais experimental do sistema — tratamos os índices subharmonic_energy_5_12hz como sinal exploratório, não como biomarcador validado.
A física por trás (densidade espectral de potência via FFT) é real. O mapeamento de faixas de Hz específicas para dicotomias emocionais não tem nenhuma fonte revisada por pares — segue o padrão de frequências solfeggio/chakra, e a origem real é a tecnologia comercial de biofeedback de voz.
Comunicamos isso explicitamente como heurística de produto FROID — nunca como neurociência validada.
Metodologia de verificação
Cada citação nesta página foi conferida de forma independente — DOI resolvido, e no caso do estudo-âncora (Zhao et al., 2022), o texto integral foi lido na fonte original para confirmar que os números batem exatamente com o que o FROID cita.