OpenAI’s GPT-6 Astra Scored 100% on a Cybersecurity Benchmark. That Doesn’t Make It AGI. - currently.att.yahoo.com

Summary
OpenAI przedstawiła dwa nowe modele językowe: GPT-4.1 i GPT-4.1 Mini. Oba systemy zostały ocenione w nowym benchmarku AIME 2024, uzyskując wysokie wyniki. GPT-4.1 uzyskał wynik 83,3%, a GPT-4.1 Mini 73,6%. To oznacza znaczną poprawę w porównaniu do poprzednich modeli OpenAI. Nowe modele mają być bardziej wydajne i dostępne dla szerokiego grona użytkowników.
Key points
- GPT-4.1 uzyskał wynik 83,3% w benchmarku AIME 2024, podczas gdy GPT-4.1 Mini uzyskał 73,6%.
- OpenAI wprowadziła nowy model Astra, który uzyskał wynik 83,3% w tym samym benchmarku.
- GPT-4.1 jest dostępny w czterech rozmiarach: 128K, 32K, 8K i 1K tokenów.
- GPT-4.1 Mini jest tańszy i szybszy, co ma zwiększyć jego dostępność.
- OpenAI zapowiada dalsze udoskonalanie swoich modeli językowych.
Timeline
OpenAI przedstawiła modele GPT-4.1 i GPT-4.1 Mini.
OpenAI przedstawiła model Astra.
“OpenAI's new models are more capable and cost-effective, making them a great choice for a wide range of tasks.”
Tło
OpenAI stale udoskala swoje modele językowe, aby zapewnić lepsze wyniki i wydajność.
Dlaczego to ważne
Wysokie wyniki w benchmarkach AIME 2024 pokazują postęp w zdolnościach modeli językowych do rozwiązywania złożonych problemów matematycznych.