Terça-feira, 29 de Setembro de 2026  |  O Senhor é misericordioso e compassivo; extremamente paciente e cheio de amor. (Salmo 145:8)
Tag

Avaliação LLM

Avaliação LLM

19 matérias encontradas

Inteligência Artificial 22/08/2026

Claude Opus 4.6: IA da Anthropic GERA Conteúdo Explícito Apesar de Restrições

Descubra como o Claude Opus 4.6 da Anthropic, apesar das proibições, foi facilmente induzido a criar conteúdo sexualmente explícito em testes do TechCrunch. Entenda a falha.

22/08/2026 às 05:18
Destaque 11/08/2026

Inteligência Artificial: Desvendando IA, Machine Learning, Deep Learning e LLMs

Desvende o universo da Inteligência Artificial com o RadarTech. Entenda o que são IA, Machine Learning, Deep Learning e LLMs de forma clara e objetiva para dominar o futuro da tecnologia.

11/08/2026 às 15:06
Inteligência Artificial 24/07/2026

Anthropic Opus 5: Novo Modelo de IA Chega Mais Acessível e Menos Restritivo

A Anthropic lança o Opus 5, um LLM mais barato e flexível que o Fable. Descubra como essa inovação redefine o acesso à IA. Clique e saiba mais!

24/07/2026 às 17:23
Inteligência Artificial 23/07/2026

Anthropic Aprimora Modo de Voz do Claude com Modelos Mais Capazes

A Anthropic atualiza o modo de voz do Claude, permitindo agendamentos e redação de e-mails. Descubra como os novos modelos tornam a IA ainda mais interativa e útil no seu dia a dia.

23/07/2026 às 21:09
Inteligência Artificial 20/07/2026

IA tende mais que humanos a criar vieses em contratações

Estudo mostra que IA pode desenvolver vieses próprios em seleção de currículos, sendo pior que humanos em contratações justas.

20/07/2026 às 10:24
Inteligência Artificial 16/07/2026

Agentes de IA: pesquisa revela perigoso hiato de avaliação em empresas

Agentes de IA ganham autonomia, mas empresas não confiam nas avaliações. Pesquisa com 157 organizações mostra riscos reais em produção.

16/07/2026 às 22:07
Inteligência Artificial 16/07/2026

Kimi 3 da Moonshot: Novo Modelo Chinês Gigante Desafia Anthropic Opus 4.8

O Moonshot Kimi 3 promete ser o maior modelo de IA da China, com até 3 trilhões de parâmetros, buscando rivalizar com o Anthropic Opus 4.8.

16/07/2026 às 15:06
Inteligência Artificial 15/07/2026

GPT-Red: OpenAI cria LLM hacker para reforçar segurança de modelos

GPT-Red é o LLM super-hacker desenvolvido pela OpenAI para treinar defesas cibernéticas. Ele tornou o GPT-5.6 o modelo mais seguro já lançado.

15/07/2026 às 18:30
Inteligência Artificial 14/07/2026

Avaliação de LLMs: Guia Essencial para Medir a Performance de Modelos de Linguagem

Descubra os principais frameworks de avaliação de LLMs como RAGAS, DeepEval e Promptfoo. Aprenda a medir a performance de seus modelos de linguagem com este guia completo e otimize resultados.

14/07/2026 às 16:16