DeepSeek V4 Flash misslyckas med agentuppgifter när priserna stiger
DeepSeeks modell V4 Flash har visat ojämn prestanda i verkliga agentuppgifter, samtidigt som dess prissättning har ökat markant.

DeepSeeks AI-modell V4 Flash, som tidigare toppat leaderboard-listor, har visat sig vara inkonsekvent i utförandet av komplexa, realtidsagentuppgifter. Enligt tester utförda av plattformen Composio lyckades modellen endast med 53,8 procent av de flerstegsoperationer som involverade verktyg som Gmail, GitHub och Slack.
Undersökningen visade att V4 Flashs prestanda varierade avsevärt beroende på vilken orkestreringsplattform, verktygskonfiguration och andra tekniska faktorer som användes. Detta belyser att modellens råa kapacitet ensamt kanske inte räcker för företagsanvändning, utan att dess integration och hantering också är avgörande.
Samtidigt har DeepSeek meddelat att de höjer priserna för sina V4 Flash- och V4 Pro-modeller med upp till 1100 procent. Prishöjningen väcker frågor om modellens konkurrenskraft på en marknad där den tidigare konkurrerade genom låga priser.
Analytiker påpekar att även om prishöjningarna minskar DeepSeeks prisfördel jämfört med konkurrenter, förblir den fortfarande billigare än många modeller från stora teknikföretag. Företag måste nu noggrant väga kostnader mot prestanda och tillförlitlighet.