Title: Modely · Steerbay
URL: https://www.steerbay.com/cs/modely/
Language: Česky (English: https://www.steerbay.comhttps://www.steerbay.com/en/models/; x-default: https://www.steerbay.comhttps://www.steerbay.com/cs/modely/)
Shrnutí: Všechny modely ve Steerbay s hodnocením: práce na webu, dlouhé úkoly, práce na počítači, kancelář, rychlost a bezpečnost, k čemu se který hodí, jaké uvažování zvolit a kolik stojí.

---

Modely

# Který model na kterou práci.

Každý model ve Steerbay, ohodnocený podle práce, kterou tu agenti dělají. Rozklikněte ho a uvidíte proč.

Claude Opus 5.5 Anthropic · Pro a Max Nejlepší na dlouhou a náročnou práci: rešerše, analýzy a úkoly na hodiny. Cena Cena: střední, 3 z 5 Celkem 9,1 z 10

Náš nejsilnější model. Sáhněte po něm, když je úkol dlouhý, otevřený nebo musí vyjít napoprvé.

- **Hodí se na**: - Úkoly na hodiny - Rešerše a analýzy s hotovým výstupem
- **Nehodí se na**: - Krátké a rutinní úkoly
- **Uvažování**: Vysoké; Max jen na nejtěžší úkoly

### Hodnocení

- **Práce na webu**: 9,0
- **Dlouhé úkoly**: 9,5
- **Práce na počítači**: 9,0
- **Kancelářská práce**: 9,5
- **Rychlost**: 7,5
- **Bezpečnost**: 9,5

### Z čeho hodnocení vychází

Claude Opus 5.5: zveřejněné výsledky a jejich zdroje

| Test | Výsledek | Zdroj |
| --- | --- | --- |
| Dlouhé úkoly |  |  |
| Terminal-Bench 4.0 Dlouhé úkoly v terminálu, nezávislé měření | 65,15 %, 1. ze 45 | [Vals AI (nová karta)](https://www.vals.ai/benchmarks/terminal-bench-4) |
| Arena Agent Práce s nástroji ve skutečných úkolech | +14,33 %, 1. místo | [Arena (nová karta)](https://arena.ai/leaderboard/agent) |
| Vending-Bench 2 Rok řízení simulovaného obchodu | zůstatek $9,235, 9. místo | [Andon Labs (nová karta)](https://andonlabs.com/evals/vending-bench-2) |
| Práce na počítači |  |  |
| OSWorld 2.1 108 dlouhých úloh na počítači, měří Anthropic | 81,8 % | [Anthropic (nová karta)](https://www.anthropic.com/claude-opus-5-5) |
| CUA-bench Ovládání podle obrazu obrazovky, nezávislé měření | 14,00 %, 2. z 8 | [Vals AI (nová karta)](https://vals.ai/models/anthropic_claude-opus-5-5) |
| Kancelářská práce |  |  |
| GDPval-AA v2.1 Odborná pracovní zadání, porovnaná ve dvojicích | Elo 1866, 1. místo | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/evaluations/gdpval-aa) |
| Rychlost |  |  |
| Artificial Analysis Rychlost výstupu | 96 tokenů/s | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/leaderboards/models) |
| Bezpečnost |  |  |
| Prompt injection Úspěšné útoky podstrčenými pokyny v prohlížeči, měří Anthropic | 0,09 % bez ochran, 0 % s nimi | [Anthropic (nová karta)](https://www-cdn.anthropic.com/fc1b44717c85dc068bc6ba5024219938094694bd/Claude%20Opus%205.5%20System%20Card.pdf) |

### Cena a údaje

- **V tarifech**: Pro a Max
- **Čerpání limitu**: Čerpá limit dvakrát rychleji než Claude Sonnet 5.5.
- **Ceníková cena poskytovatele**: 4 $ za milion vstupních tokenů, 20 $ za milion výstupních
- **Vydáno**: \22. září 2026
- **Kontextové okno**: 1 milion tokenů

Sol 6.1 OpenAI · Plus, Pro a Max Naše volba na práci na webu: v nezávislém testu prohlížení první a za nízkou cenu. Cena Cena: nízká, 2 z 5 Celkem 8,8 z 10

Doporučený model na většinu práce na webu. V nezávislém testu prohlížení porazil všechny ostatní modely.

- **Hodí se na**: - Vyhledávání a porovnávání cen na webech - Formuláře a postupy o mnoha krocích
- **Nehodí se na**: - Nejdelší otevřené úkoly
- **Uvažování**: Střední na webu; vysoké na dlouhé úkoly

### Hodnocení

- **Práce na webu**: 9,5
- **Dlouhé úkoly**: 8,5
- **Práce na počítači**: 8,5
- **Kancelářská práce**: 8,0
- **Rychlost**: 8,5
- **Bezpečnost**: 8,0

### Z čeho hodnocení vychází

Sol 6.1: zveřejněné výsledky a jejich zdroje

| Test | Výsledek | Zdroj |
| --- | --- | --- |
| Práce na webu |  |  |
| Browser Use Bench v2.1 180 dlouhých úkolů na skutečných webech | 79,6, 1. místo | [Browser Use (nová karta)](https://browser-use.com/benchmarks/agents) |
| Dlouhé úkoly |  |  |
| SRE Bench Řešení výpadků serverů, nezávislé měření | 50,76 %, 2. z 33 | [Vals AI (nová karta)](https://vals.ai/models/openai_gpt-6.1-sol) |
| Terminal-Bench 4.0 Dlouhé úkoly v terminálu, nezávislé měření | 55,05 %, 6. ze 45 | [Vals AI (nová karta)](https://www.vals.ai/benchmarks/terminal-bench-4) |
| Arena Agent Práce s nástroji ve skutečných úkolech | +11,72 %, 5. místo | [Arena (nová karta)](https://arena.ai/leaderboard/agent) |
| Práce na počítači |  |  |
| OSWorld 2.0 Úlohy na počítači, offline sada, měří OpenAI | 71,4 % | [OpenAI (nová karta)](https://openai.com/index/introducing-gpt-6-1-sol/) |
| Kancelářská práce |  |  |
| GDPval-AA v2.1 Odborná pracovní zadání, porovnaná ve dvojicích | Elo 1592, 33. místo | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/evaluations/gdpval-aa) |
| Rychlost |  |  |
| Browser Use Bench v2.1 Průměrná doba jednoho úkolu na webu | 8 minut | [Browser Use (nová karta)](https://browser-use.com/benchmarks/agents) |
| Bezpečnost |  |  |
| Safety stress test Nebezpečné kroky v zátěžovém testu na počítači, měří OpenAI (méně je lépe) | 4,3 % | [OpenAI (nová karta)](https://openai.com/index/introducing-gpt-6-1-sol/) |

### Cena a údaje

- **V tarifech**: Plus, Pro a Max
- **Čerpání limitu**: Čerpá limit stejně rychle jako Claude Sonnet 5.5.
- **Ceníková cena poskytovatele**: 2 $ za milion vstupních tokenů, 10 $ za milion výstupních
- **Celý název**: GPT-6.1 Sol
- **Vydáno**: \29. září 2026
- **Kontextové okno**: 1,05 milionu tokenů

Claude Sonnet 5.5 Anthropic · Zdarma, Plus, Pro a Max Spolehlivý model na každý den, nejbezpečnější v prohlížeči. Je v každém tarifu. Cena Cena: nízká, 2 z 5 Celkem 8,7 z 10

Bezpečná volba na každodenní úkoly, dokumenty a práci na neznámých webech.

- **Hodí se na**: - Dokumenty, tabulky a prezentace - Práce na neznámých webech
- **Nehodí se na**: - Otevřené úkoly na mnoho hodin
- **Uvažování**: Vysoké; velmi vysoké na dlouhé úkoly

### Hodnocení

- **Práce na webu**: 8,0
- **Dlouhé úkoly**: 9,0
- **Práce na počítači**: 8,5
- **Kancelářská práce**: 9,5
- **Rychlost**: 8,5
- **Bezpečnost**: 10

### Z čeho hodnocení vychází

Claude Sonnet 5.5: zveřejněné výsledky a jejich zdroje

| Test | Výsledek | Zdroj |
| --- | --- | --- |
| Dlouhé úkoly |  |  |
| Terminal-Bench 4.0 Dlouhé úkoly v terminálu, nezávislé měření | 64,14 %, 2. ze 45 | [Vals AI (nová karta)](https://www.vals.ai/benchmarks/terminal-bench-4) |
| Vending-Bench 2 Rok řízení simulovaného obchodu | zůstatek $11,165, 5. místo | [Andon Labs (nová karta)](https://andonlabs.com/evals/vending-bench-2) |
| Arena Agent Práce s nástroji ve skutečných úkolech | +11,95 %, 4. místo | [Arena (nová karta)](https://arena.ai/leaderboard/agent) |
| Práce na počítači |  |  |
| OSWorld 2.1 108 dlouhých úloh na počítači, měří Anthropic | 80,1 % | [Anthropic (nová karta)](https://www-cdn.anthropic.com/870c8f525702625d2c62fc6dd04c857e3250bec1/Claude%20Sonnet%205.5%20System%20Card.pdf) |
| Kancelářská práce |  |  |
| GDPval-AA v2.1 Odborná pracovní zadání, porovnaná ve dvojicích | Elo 1838, 2. místo | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/evaluations/gdpval-aa) |
| Rychlost |  |  |
| Artificial Analysis Rychlost výstupu | 141 tokenů/s | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/leaderboards/models) |
| Bezpečnost |  |  |
| Prompt injection Úspěšné útoky podstrčenými pokyny v prohlížeči, měří Anthropic | 0 % s ochranami i bez nich | [Anthropic (nová karta)](https://www-cdn.anthropic.com/870c8f525702625d2c62fc6dd04c857e3250bec1/Claude%20Sonnet%205.5%20System%20Card.pdf) |

### Cena a údaje

- **V tarifech**: Zdarma, Plus, Pro a Max
- **Čerpání limitu**: Výchozí míra: s ní porovnáváme ostatní modely.
- **Ceníková cena poskytovatele**: 2 $ za milion vstupních tokenů, 10 $ za milion výstupních
- **Vydáno**: \28. září 2026
- **Kontextové okno**: 1 milion tokenů

Astra 6 OpenAI · Pro a Max Velmi schopný, ale na prohlížení pomalý a drahý. Nechte ho na nejtěžší práci na počítači. Cena Cena: velmi vysoká, 5 z 5 Celkem 8,4 z 10

Silný na počítači a v dlouhém provozu, ale na běžné prohlížení je to zbytečně velký model. Sol 6.1 je na webu lepší.

- **Hodí se na**: - Nejtěžší úkoly v aplikacích - Práce, kterou Sol 6.1 nedokončil
- **Nehodí se na**: - Běžné prohlížení webu
- **Uvažování**: Střední na webu; vysoké na počítači

### Hodnocení

- **Práce na webu**: 8,5
- **Dlouhé úkoly**: 8,5
- **Práce na počítači**: 9,0
- **Kancelářská práce**: 8,0
- **Rychlost**: 7,0
- **Bezpečnost**: 8,5

### Z čeho hodnocení vychází

Astra 6: zveřejněné výsledky a jejich zdroje

| Test | Výsledek | Zdroj |
| --- | --- | --- |
| Práce na webu |  |  |
| Browser Use Bench v2.1 180 dlouhých úkolů na skutečných webech | 77,9, 2. místo | [Browser Use (nová karta)](https://browser-use.com/benchmarks/agents) |
| Dlouhé úkoly |  |  |
| Vending-Bench 2 Rok řízení simulovaného obchodu | zůstatek $15,515, 1. místo | [Andon Labs (nová karta)](https://andonlabs.com/evals/vending-bench-2) |
| Terminal-Bench 4.0 Dlouhé úkoly v terminálu, nezávislé měření | 59,60 %, 3. ze 45 | [Vals AI (nová karta)](https://www.vals.ai/benchmarks/terminal-bench-4) |
| Arena Agent Práce s nástroji ve skutečných úkolech | +13,09 %, 2. místo | [Arena (nová karta)](https://arena.ai/leaderboard/agent) |
| Práce na počítači |  |  |
| CUA-bench Ovládání podle obrazu obrazovky, nezávislé měření | 19,17 %, 1. z 8 | [Vals AI (nová karta)](https://vals.ai/models/openai_gpt-6-astra) |
| Kancelářská práce |  |  |
| GDPval-AA v2.1 Odborná pracovní zadání, porovnaná ve dvojicích | Elo 1574, 37. místo | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/evaluations/gdpval-aa) |
| Rychlost |  |  |
| Artificial Analysis Rychlost výstupu | 47 tokenů/s | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/leaderboards/models) |
| Bezpečnost |  |  |
| Safety stress test Nebezpečné kroky v zátěžovém testu na počítači, měří OpenAI (méně je lépe) | 2,4 % | [OpenAI (nová karta)](https://openai.com/index/introducing-gpt-6-1-sol/) |

### Cena a údaje

- **V tarifech**: Pro a Max
- **Čerpání limitu**: Čerpá limit pětkrát rychleji než Claude Sonnet 5.5.
- **Ceníková cena poskytovatele**: 10 $ za milion vstupních tokenů, 50 $ za milion výstupních
- **Celý název**: GPT-6 Astra
- **Vydáno**: \3. září 2026
- **Kontextové okno**: 1,05 milionu tokenů

Luna 6 OpenAI · Plus, Pro a Max Rychlý a velmi levný na jednoduché úkoly: dohledání a třídění, ne dlouhá práce. Cena Cena: velmi nízká, 1 z 5 Celkem 6,4 z 10

Na jednoduchou práci ve velkém množství. Cokoli o mnoha krocích dejte Sol 6.1 nebo Claude Sonnet 5.5.

- **Hodí se na**: - Rychlé dohledání jednoho údaje - Třídění a krátká shrnutí
- **Nehodí se na**: - Úkoly o mnoha krocích
- **Uvažování**: Vysoké až velmi vysoké; nízké jen na jeden krok

### Hodnocení

- **Práce na webu**: 7,0
- **Dlouhé úkoly**: 5,0
- **Práce na počítači**: 5,5
- **Kancelářská práce**: 6,5
- **Rychlost**: 9,0
- **Bezpečnost**: 5,5

### Z čeho hodnocení vychází

Luna 6: zveřejněné výsledky a jejich zdroje

| Test | Výsledek | Zdroj |
| --- | --- | --- |
| Práce na webu |  |  |
| Browser Use Bench v2.1 180 dlouhých úkolů na skutečných webech | 69,0, 12. místo | [Browser Use (nová karta)](https://browser-use.com/benchmarks/agents) |
| Dlouhé úkoly |  |  |
| Terminal-Bench 4.0 Dlouhé úkoly v terminálu, nezávislé měření | 13,64 %, 29. ze 45 | [Vals AI (nová karta)](https://www.vals.ai/benchmarks/terminal-bench-4) |
| Arena Agent Práce s nástroji ve skutečných úkolech | +1,93 %, 25. místo | [Arena (nová karta)](https://arena.ai/leaderboard/agent) |
| Práce na počítači |  |  |
| OSWorld 2.0 Úlohy na počítači, nejvyšší uvažování, měří OpenAI | 52,7 % | [OpenAI (nová karta)](https://openai.com/index/introducing-gpt-6-sol-and-luna/) |
| Kancelářská práce |  |  |
| GDPval-AA v2.1 Odborná pracovní zadání, porovnaná ve dvojicích | Elo 1432, 64. místo | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/evaluations/gdpval-aa) |
| Rychlost |  |  |
| Artificial Analysis Rychlost výstupu | 139 tokenů/s | [Artificial Analysis (nová karta)](https://artificialanalysis.ai/leaderboards/models) |
| Bezpečnost |  |  |
| Safety stress test Nebezpečné kroky v zátěžovém testu na počítači, měří OpenAI (méně je lépe) | 13,7 % | [OpenAI (nová karta)](https://openai.com/index/introducing-gpt-6-1-sol/) |

### Cena a údaje

- **V tarifech**: Plus, Pro a Max
- **Čerpání limitu**: Čerpá limit zhruba dvacetkrát pomaleji než Claude Sonnet 5.5.
- **Ceníková cena poskytovatele**: 0,10 $ za milion vstupních tokenů, 0,50 $ za milion výstupních
- **Celý název**: GPT-6 Luna
- **Vydáno**: \22. září 2026
- **Kontextové okno**: 1,05 milionu tokenů

- výborné 9+
- velmi dobré 8+
- dobré 7+
- slabé pod 7

Známky do 10. Naposledy zkontrolováno 11. října 2026.

Srovnání

## Všechny modely vedle sebe.

Hodnocení modelů podle oblastí, uvažování, cena a tarify

| Model | Celkem | Práce na webu | Dlouhé úkoly | Práce na počítači | Kancelářská práce | Rychlost | Bezpečnost | Uvažování | Cena | Tarify |
| --- | --- | --- | --- | --- | --- | --- | --- | --- | --- | --- |
| [Claude Opus 5.5](https://www.steerbay.com/cs/modely/#opus-5-5) | 9,1 | 9,0 | 9,5 | 9,0 | 9,5 | 7,5 | 9,5 | Vysoké; Max jen na nejtěžší úkoly | Cena: střední, 3 z 5 | Pro a Max |
| [Sol 6.1](https://www.steerbay.com/cs/modely/#sol-6-1) | 8,8 | 9,5 | 8,5 | 8,5 | 8,0 | 8,5 | 8,0 | Střední na webu; vysoké na dlouhé úkoly | Cena: nízká, 2 z 5 | Plus, Pro a Max |
| [Claude Sonnet 5.5](https://www.steerbay.com/cs/modely/#sonnet-5-5) | 8,7 | 8,0 | 9,0 | 8,5 | 9,5 | 8,5 | 10 | Vysoké; velmi vysoké na dlouhé úkoly | Cena: nízká, 2 z 5 | Zdarma, Plus, Pro a Max |
| [Astra 6](https://www.steerbay.com/cs/modely/#astra-6) | 8,4 | 8,5 | 8,5 | 9,0 | 8,0 | 7,0 | 8,5 | Střední na webu; vysoké na počítači | Cena: velmi vysoká, 5 z 5 | Pro a Max |
| [Luna 6](https://www.steerbay.com/cs/modely/#luna-6) | 6,4 | 7,0 | 5,0 | 5,5 | 6,5 | 9,0 | 5,5 | Vysoké až velmi vysoké; nízké jen na jeden krok | Cena: velmi nízká, 1 z 5 | Plus, Pro a Max |

Jak hodnotíme

## Šest věcí, na kterých záleží.

Celkové hodnocení je vážený průměr šesti známek. Nejvíc váží práce na webu, protože tam agenti pracují nejčastěji. Cena do hodnocení nevstupuje.

- **35 % Práce na webu**: Najde a udělá, co má, na skutečných webech.
- **20 % Dlouhé úkoly**: Vydrží u práce na desítky kroků a dotáhne ji.
- **15 % Práce na počítači**: Ovládá aplikace podle toho, co vidí na obrazovce.
- **10 % Kancelářská práce**: Dokumenty, tabulky, rešerše a analýzy.
- **10 % Rychlost**: Jak rychle odpovídá a dokončí úkol.
- **10 % Bezpečnost**: Nenechá se svést pokyny podstrčenými na webu.

Podrobné důvody každé známky a rady k uvažování najdete v návodu [Modely](https://www.steerbay.com/cs/docs/models/), tarify v [ceníku](https://www.steerbay.com/cs/cenik/).

## Vyzkoušejte je na vlastní práci.

Model změníte kdykoli; soubory, konverzace i přihlášení zůstávají. Nevíte si rady? Zeptejte se AI nápovědy.

[Otevřít aplikaci](https://app.steerbay.com/)
