› Mistral Large 4 dostał w moim teście po polsku 69,2 pkt na 100 z rozumowaniem i 65,6 pkt bez niego.
› To poziom poprzedniego flagowca Mistrala, Medium 3.5, i wyraźnie mniej niż Claude Sonnet 5.5, GPT-6.1 Sol czy DeepSeek V4 Pro.
› Świetnie zna polszczyznę (quiz 46/46), ale w trybie rozumowania potrafi „przemyśleć” cały limit tokenów i nie oddać odpowiedzi.
› O samej premierze piszę w newsie Mistral Large 4, a o firmie w hubie Mistral AI.