
Google представи своя нов модел Gemini 2.5 Pro. За него от компанията твърдят, че е най-умният AI модел създаван досега. И това може и да не са просто празни приказки – моделът заема първи места в класациите на LMArena, където потребителите оценяват различните AI модели.
Една от най-важните характеристики на Gemini 2.5 Pro е подобрената му способност за разсъждение. За разлика от по-старите модели на компанията, които разчитат главно на разпознаване на модели изградени на базата на тренировъчни данни, Gemini 2.5 Pro е истински “мислещ модел”. Той анализира информацията, обмисля различни решения и избира най-доброто, преди да отговори. Това му позволява да прави логически заключения, да разбира контекста и нюансите, и да взема по-информирани решения – почти като човек.
Според Google, кодирането е областта, където Gemini 2.5 Pro се откроява от останалите благодарение на напредналите си възможности. Той създава визуално привлекателни уеб приложения и “агентни” приложения за кодиране, които работят самостоятелно. Демонстрациите показват как моделът генерира интерактивни анимации, прави прости игри и визуализира сложни данни само от кратки текстови инструкции. Впечатляващият резултат от 63.8% на SWE-Bench Verified (индустриален стандарт за “агентно” кодиране) подчертава способността му да се справя със задачи за кодиране с множество последователни стъпки.
Следващия плюс, който отбелязват създателите на модела е , че Gemini 2.5 Pro идва с вградена мултимодалност – разбира и обработва информация от различни източници: текст, аудио, изображения и видео. Това му позволява да взаимодейства с данни по-естествено, комбинирайки различни видове информация за по-пълно разбиране и изпълнение на по-сложни задачи. Например, може да анализира видео, да извлече ключови моменти и да направи резюме в реално време.
Друго голямо предимство е огромният контекстов прозорец – цели 1 милион токена, с планове скоро да стане 2 милиона. Този впечатляващ капацитет позволява на модела да обработва огромни количества информация наведнъж: цели кодови хранилища, дълги научни доклади, продължителни аудио записи. При това запазва контекста и дава по-точни отговори при сложни задачи.
Gemini 2.5 Pro се справя добре в тестовете и постига добри резултати:
Сравнявайки новия модел с предишните версии на Gemini и с конкурентите като GPT-4.5, Claude 3.7 Sonnet и Grok 3, се вижда значителен напредък. В много задачи, Gemini 2.5 Pro превъзхожда Gemini 2.0, особено в кодирането. Често дава по-добри резултати от GPT-4.5 и Claude 3.7 Sonnet в различни тестове. Въпреки че в някои специфични тестове (например AIME 2025) резултатите са близки до GPT-4.5, а в други (като SWE-Bench) Claude 3.7 Sonnet все още води, като цяло Gemini 2.5 Pro се очертава като сериозен конкурент и понякога лидер сред най-добрите AI модели. Някои потребители споделят, че Grok 3 се представя по-добре в определени области като физиката, а Claude все още е по-добър в програмирането. Въпреки това, твърденията на Google са, че общата производителност на Gemini 2.5 Pro е по-висока.
Ето таблица с резултатите от тестовете за сравнение:
| Бенчмарк | Gemini 2.5 Pro | Gemini 2.0 | GPT-4.5 | Claude 3.7 Sonnet | Grok 3 |
|---|---|---|---|---|---|
| LMArena | 1443 | 1380 | Н/Д | Н/Д | 1404 |
| Humanity’s Last Exam (no tools) | 18.8% | Н/Д | ~6.4% | ~8.9% | ~14% |
| GPQA Diamond | 84% | Н/Д | 79% | ~80% | ~72% |
| AIME 2025 | 86.7% | Н/Д | 86.5% | ~77% | ~50% |
| SWE-Bench Verified | 63.8% | Н/Д | Н/Д | 70.3% | Н/Д |
Експертите и технологичните блогъри дават много положителни оценки на Gemini 2.5 Pro. Те го определят като голям скок напред в AI технологията, особено заради подобреното разсъждение, напредналите възможности за кодиране и естествената мултимодалност. Някои дори смятат, че Gemini 2.5 Pro може да измести други водещи модели като Claude 3.7 Sonnet.
Изпробвах модела и честно казано не съм впечатлен от възможностите му на “програмист”. Поисках да промени Python скрипт, така, че вместо да ползва Claude API, да изпълнява задачите си използвайки Gemini API. Въпреки, че задачата е по-скоро елементарна, резултатът беше поредица от бъгове и тестове, като накрая програмата заработи, но за сравнение – същата задача с Grok ми отне доста по-малко време, а резултата беше по-добър.
Това, което ми направи много добро впечатление са текстовете, които генерира модела. При добри настройки и подходящ промпт, Gemini 2.5 написа доста качествени текстове на английски и български, които са равностойни на тези генерирани от Claude и по-добри от тези на ChаtGPT и Grok.
Важно е да се отбележи, че тъй като Gemini 2.5 Pro е все още в експериментална фаза, вероятно ще има още промени и подобрения.
Технически погледнато, Gemini 2.5 Pro впечатлява с входен лимит от 1,000,000 токена и изходен лимит от 64,000 токена – огромно увеличение спрямо предишните модели. Това му позволява да обработва изключително дълги текстове и да генерира обширни, детайлни отговори. Базата знания на модела е актуална към януари 2025 г., което е подобрение спрямо Gemini 2.0 и осигурява достъп до по-нова информация.
Достъпът до Gemini 2.5 Pro е възможен по няколко начина. Експериментална версия се предлага безплатно в Google AI Studio. Моделът е достъпен и за потребителите на Gemini Advanced, а скоро се очаква да се появи и във Vertex AI. Разработчик е Google DeepMind, а експерименталната версия беше пусната на 25 март 2025 г.