DeepSeek

Latest AI news, models and releases from DeepSeek. ['DeepSeek', 'DeepSeek 3.1', 'DeepSeek-4-pro', 'DeepSeek API', 'deepseek-coder-v2', 'DeepSeek-Coder-V2-Lite', 'DeepSeek-GRM', 'DeepSeek large model', 'DeepSeekMath-V2', 'DeepSeekMoE', 'DeepSeek-Prover-V1.5-Base', 'DeepSeek-Prover-V2', 'DeepSeek-Prover-V2-671B', 'DeepSeek-Prover-V2-7B', 'DeepSeek R1', 'DeepSeek-R1', 'DeepSeek R1-0528', 'DeepSeek-R1-0528', 'DeepSeek-R1-671B', 'DeepSeek-R1-Distilled-Llama-70B', 'DeepSeek-R1-Distilled-Qwen-32B', 'DeepSeek-R1-Distill-Qwen-32B', 'DeepSeek-R1-Zero', 'DeepSeek R2', 'DeepSeek-R2', 'DeepSeek Sparse Attention (DSA)', 'DeepSeek V1', 'DeepSeek V2', 'DeepSeek-V2', 'DeepSeek-V2.5', 'DeepSeek V3', 'DeepSeek-V3', 'DeepSeek V3.1', 'DeepSeek V3.1-Terminus', 'DeepSeek v3.2', 'DeepSeek V3.2', 'DeepSeek-V3.2', 'DeepSeek V3.2-Exp', 'DeepSeek-V3-Base', 'DeepSeek V3/R1']

Applications 🇷🇺

How to reduce LLM costs by 70 times: experience migrating from Claude Sonnet to Qwen 3.5 Flash

JobPath migrated from expensive Claude Sonnet to cheap Qwen 3.5 Flash for job card generation, cutting monthly costs from ~$2000 to ~$30 while quality dropped slightly from 4.48 to 4.06 on a 1-5 scale. The article details selection via evaluation with a blind judge, issues with cheap models (empty responses, type mismatches, field typos), and error-handling lessons including a billing mistake that wasted 16,000 calls in one night.

AnthropicAnthropic Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek
Habr — хаб NLP24.07 · 06:03
Fresh news