A OpenAI lançou o GPT-5.5, que superou por pequena margem o Claude Mythos Preview, da Anthropic, no Terminal-Bench 2.0. O resultado foi divulgado em publicação da VentureBeat nesta semana.

O teste avalia desempenho em tarefas técnicas e de linguagem. Não foram divulgados detalhes adicionais sobre as métricas ou data exata do benchmark.