Çin merkezli yapay zeka firması DeepSeek, açık kaynaklı matematiksel akıl yürütme modeli DeepSeekMath-V2’yi yayımladı. Model, Hugging Face ve GitHub üzerinden erişime açıldı.
DeepSeekMath-V2, iki büyük dil modelinin birlikte çalıştığı bir self-verifying (kendi kendini doğrulayan) çerçeveye sahip. Bu sistemde bir model matematiksel kanıtlar üretirken, diğeri bu kanıtları inceleyip doğruluyor.
Model, 2025 Uluslararası Matematik Olimpiyatı (IMO) ve 2024 Çin Matematik Olimpiyatı sınavlarındaki sonuçları insanlardaki en yüksek skorlarla eşleşti. Ayrıca 2024 Putnam Sınavı’nda 120 üzerinden 118 puan alarak insan tarihindeki en yüksek puan olan 90’ı geçti.
DeepSeekMath-V2, DeepMind’in DeepThink modelini IMO-ProofBench değerlendirmesinde geride bıraktı. Şirket, bu yaklaşımın yalnızca doğru sonuçlar üretmekle kalmayıp aynı zamanda sağlam ve mantıklı akıl yürütmeyi de garanti ettiğini belirtti.

