Synology

AI sprawdza się w cyberbezpieczeństwie

AI sprawdza się w cyberbezpieczeństwie

Model chińskiego startupu AI imponuje w niszowych dziedzinach, takich jak cyberbezpieczeństwo, jednak ogólne możliwości modelu pozostawiły część programistów z poczuciem niedosytu – zaznaczył serwis SCMP.com.

Chiński startup DeepSeek, działający w branży sztucznej inteligencji, po cichu wprowadził na rynek DeepSeek-V4-Pro-0813 – zaktualizowaną wersję swojego najnowszego flagowego modelu. Choć rozwiązanie to zaimponowało badaczom w niszowych obszarach, takich jak cyberbezpieczeństwo, część programistów wyraziła rozczarowanie zarówno ogólnymi możliwościami modelu, jak i jego ceną – czytamy.

Wprowadzeniu tej cichej aktualizacji (będącej następcą wersji poglądowej z kwietnia) towarzyszył krótki komunikat na oficjalnej stronie DeepSeek, w którym wspomniano o „znacznie rozszerzonych możliwościach agentowych” modelu; wpis ten został jednak usunięty do czwartkowego popołudnia. Premiera ta następuje po debiucie mniejszego modelu firmy – V4 Flash – który w zeszłym miesiącu wywołał poruszenie w Dolinie Krzemowej dzięki swojej wyjątkowej efektywności kosztowej.
Wstępne wyniki testów porównawczych sugerują jednak, że nowy flagowy model ma trudności z dorównaniem konkurentom z najwyższej półki – podkreślono.

Model DeepSeek-V4-Pro-0813 uzyskał wynik 53 punkty w rankingu Artificial Analysis Intelligence Index, co stawia go na równi z modelem GLM-5.2 firmy Zhipu AI (wydanym w czerwcu). Wynik ten był jednak o cztery punkty niższy od osiągnięcia modelu Terra (klasy średniej) z najnowszej serii GPT-5.6 firmy OpenAI oraz o siedem punktów niższy od wyniku modelu Kimi K3 firmy Moonshot AI – czytamy dalej.

W rankingu Vals Index, opracowywanym przez firmę Vals AI z siedzibą w San Francisco w celu oceny modeli na podstawie szeregu testów porównawczych, nowy model DeepSeek zajął 12. miejsce. Ustąpił on modelowi GPT-5.5 poprzedniej generacji od OpenAI, a także znacznie odbiegał od wiodących systemów, takich jak Kimi K3 czy Claude Opus 5 firmy Anthropic – wskazano.

Jak poinformowała w środę firma Vals AI, model miał szczególne trudności w dwóch obszarach: wykonywaniu zadań w izolowanym środowisku terminala (tzw. piaskownicy) oraz tworzeniu złożonych modeli finansowych w arkuszach kalkulacyjnych Excel – podano.

W mediach społecznościowych wstępne wyniki skłoniły niektórych programistów i obserwatorów branży do określenia modelu firmy z Hangzhou mianem „rozczarowującego”; użytkownicy wskazywali m.in. na problemy z przedwczesnym przerywaniem pracy podczas długich zadań związanych z programowaniem – wskazano w treści informacji.

Firma DeepSeek nie odpowiedziała od razu na czwartkową prośbę o komentarz – napisano dalej.

Mimo mieszanego odbioru, model wyróżnił się skutecznością w zakresie cyberbezpieczeństwa. Według belgijskiej firmy Aikido Security, model DeepSeek-V4-Pro-0813 okazał się lepszy od wszystkich innych testowanych modeli pod względem wykrywania luk w zabezpieczeniach systemów – podkreślono w analizie.

Choć model cechował się „niską precyzją”, wykrył znacznie więcej luk w zabezpieczeniach niż Opus 5 firmy Anthropic czy Qwen 3.8 należący do Alibaba Group Holding – powiedział w czwartek badacz z Aikido, Philippe Dourassov.

OpenAI ustępuje w rywalizacji z chińskimi konkurentami, znacząco obniżając ceny
Alibaba jest właścicielem dziennika South China Morning Post – przypomniał serwis.

W przeciwieństwie do typowych premier modeli AI, firma DeepSeek nie opublikowała jeszcze wpisu na blogu technicznym na temat nowej wersji – czytamy.

Cena oficjalnego modelu Pro również wywołała mieszane reakcje, zwłaszcza w kontekście wcześniejszych pochwał dla niezwykle taniego modelu V4 Flash, udostępnionego 31 lipca – podano.

Koszt modelu DeepSeek-V4-Pro-0813 to około 44 centy amerykańskie za milion tokenów wejściowych – co firma Artificial Analysis określiła jako „nieco drogo” w porównaniu z rynkową medianą wynoszącą 33 centy – oraz 87 centów za milion tokenów wyjściowych, co uznano za cenę „umiarkowaną”. Według wskaźnika Artificial Analysis Intelligence Index koszt uruchomienia tego modelu wynosi 6 centów za zadanie; jest on zatem nieco droższy w eksploatacji niż lekki model GPT-5.6 Luna firmy OpenAI (5 centów), ale pozostaje o blisko 93% tańszy od modelu Kimi K3 firmy Moonshot AI (84 centy) – wskazano w treści.

W zeszłym tygodniu firma DeepSeek zapowiedziała „znaczną” podwyżkę cen spowodowaną gwałtownym wzrostem popytu, zalecając użytkownikom odpowiednie planowanie korzystania z usług – napisano.

Jednocześnie oczekuje się, że DeepSeek wkrótce wprowadzi na rynek rozwiązanie typu „harness” – środowisko programistyczne (framework) podobne do Claude Code, które umożliwia dużym modelom językowym funkcjonowanie w roli autonomicznych agentów AI – czytamy dalej.

Na początku tego miesiąca firma zaprosiła programistów rozwiązań open-source do udziału w testach beta nadchodzącego narzędzia DeepSeek Harness; wcześniej, w lipcu, zarejestrowała dla swojego zespołu konto w serwisie WeChat – podano w podsumowaniu.     (jmk)

Foto: Pixabay.com
Źródło: SCMP.com

Portal internetowy ForumBiznesu.pl

Portal internetowy ForumBiznesu.pl

Portal internetowy ForumBiznesu.pl

Portal internetowy ForumBiznesu.pl

Publish the Menu module to "offcanvas" position. Here you can publish other modules as well.
Learn More.