...
Podle mě tohle platilo naposledy tak před 1-2 lety. Dnešní modely mají přímo natrénované uvažování (reasoning, test-time scaling) nezávisle na jazyku, prompt si rozeberou, pak nad ním uvažují a pak vydají odpověď. Použití minoritního jazyka bude maximálně stát trochu tokenů navíc (hůř se embeduje). Je to vidět i v tom odkazovaném paperu:
The effect of language differed significantly by model. Qwen2.5, Llama3.3, Meditron3, and OpenBioLLM performed significantly better in English, with the largest gap observed for Qwen2.5. GPT-5 and Bielik showed no statistically detectable English-Polish difference in overall score in this sample.
I.e., staré modely měly problém, GPT-5 (a to už je s námi přes rok) už je to jedno.
Každopádně taky píšu anglicky. Občas si říkám, co si asi myslí, když to potká různé české bugreporty, poznámky a tak. Výjimečně má tendenci mi je překládat, protože si myslí, že jim nerozumím - zkoušel jsem psát do CLAUDE.md že česky rozumím a není to potřeba, ale reakce na to byla, že to začalo _psát_ česky komentáře, což fakt nechci.