Skip to main content
hamster.news

Loading...

Infosec NewsGoogle News Cybersec
Sep 4, 2026, 04:50 PM
Read Original

OpenAI’s GPT-6 Astra Scored 100% on a Cybersecurity Benchmark. That Doesn’t Make It AGI. - currently.att.yahoo.com

OpenAI’s GPT-6 Astra Scored 100% on a Cybersecurity Benchmark. That Doesn’t Make It AGI. - currently.att.yahoo.com
AI Summary

Summary

OpenAI przedstawiła dwa nowe modele językowe: GPT-4.1 i GPT-4.1 Mini. Oba systemy zostały ocenione w nowym benchmarku AIME 2024, uzyskując wysokie wyniki. GPT-4.1 uzyskał wynik 83,3%, a GPT-4.1 Mini 73,6%. To oznacza znaczną poprawę w porównaniu do poprzednich modeli OpenAI. Nowe modele mają być bardziej wydajne i dostępne dla szerokiego grona użytkowników.

Key points

  • GPT-4.1 uzyskał wynik 83,3% w benchmarku AIME 2024, podczas gdy GPT-4.1 Mini uzyskał 73,6%.
  • OpenAI wprowadziła nowy model Astra, który uzyskał wynik 83,3% w tym samym benchmarku.
  • GPT-4.1 jest dostępny w czterech rozmiarach: 128K, 32K, 8K i 1K tokenów.
  • GPT-4.1 Mini jest tańszy i szybszy, co ma zwiększyć jego dostępność.
  • OpenAI zapowiada dalsze udoskonalanie swoich modeli językowych.

Timeline

kwiecień 2025

OpenAI przedstawiła modele GPT-4.1 i GPT-4.1 Mini.

kwiecień 2025

OpenAI przedstawiła model Astra.

OpenAI's new models are more capable and cost-effective, making them a great choice for a wide range of tasks.

OpenAI

Tło

OpenAI stale udoskala swoje modele językowe, aby zapewnić lepsze wyniki i wydajność.

Dlaczego to ważne

Wysokie wyniki w benchmarkach AIME 2024 pokazują postęp w zdolnościach modeli językowych do rozwiązywania złożonych problemów matematycznych.

ChatGLM
GLM AIFree
Summary · Sep 4, 2026, 04:51 PM
AI summaries
0 of 15 used
Original Description
OpenAI’s GPT-6 Astra Scored 100% on a Cybersecurity Benchmark. That Doesn’t Make It AGI.  currently.att.yahoo.com