DeepSeek V4-Flash-Vision-Exp dsh v0.1.1-ში შემოვიდა
DeepSeek-მა გამოუშვა V4-Flash-ის იდენტურად დაფასებული vision მოდელი, ხოლო dsh v0.1.1-rc.1 ერთდროულად ადაპტირებს მას და ასწორებს Bubblewrap sandbox გაქცევას.
August 21-ს DeepSeek-მა ორი რამ გამოუშვა რამდენიმე საათის სხვაობით, და ეს ერთი ამბავია: vision მოდელი API-ზე, და dsh გამოშვება, რომელსაც მისი მართვა შეუძლია.
ჯერ განაახლეთ: sandbox გაქცევა გამოსწორდა
v0.1.1-rc.1 ასწორებს Bubblewrap sandbox გაქცევას — შეზღუდულ პროცესებს შეეძლოთ შეზღუდვების გვერდის ავლა /proc/<pid>/root-ით. თუ dsh-ს Bubblewrap sandbox-ით უშვებთ კოდზე, რომელსაც არ ენდობით, სწორედ ამიტომ უნდა განაახლოთ ახლა და არა მოგვიანებით, როცა მოგცემთ დრო.
ეს ასევე პირველი ვერსიის ნომრის აწევაა გაშვების შემდეგ: ყველა წინა გამოშვება იყო 0.1.0-ის release candidate, ეს კი 0.1.1-rc.1.
Vision მოდელი
deepseek-v4-flash-vision-exp. ექსპერიმენტული, 1M კონტექსტი.
- ტექსტი: V4-Flash-ის დონეზე, DeepSeek-ის მიხედვით.
- Vision: ვიზუალურ agent ბენჩმარკებზე მნიშვნელოვნად უსწრებს მხოლოდ-ტექსტურ Flash-ს — DeepSeek-ის საკუთარი ფორმულირება მას Opus-4.8-თან ახლოს აყენებს.
- ფასი: V4-Flash-ის იდენტური. Vision-ს პრემიუმი არ აქვს.
| 1M token-ზე | პიკი | პიკის გარეთ | | --- | --- | --- | | შეყვანა, cache hit | $0.014 | $0.007 | | შეყვანა, cache miss | $0.44 | $0.22 | | გამოტანა | $1.32 | $0.66 |
მომწოდებლის ბენჩმარკები: Terminal Bench 2.1 83.9 (V4-Flash-მა მიიღო 82.7), DeepSWE 59.3, DSBench-Hard 63.6, Chartography 64.3, ZeroBench (Pass@5) 35.0, Agents' Last Exam 27.3.
ორი დათქმა დასამახსოვრებელია. ეს DeepSeek-ის საკუთარი ციფრებია, არავის გაუმეორებია. და Exp ნიშნავს ექსპერიმენტულს — სტაბილურობის დაპირება არ არის, ექსპერიმენტული endpoint-ები კი სწორედ ისინია, რომლებსაც ხსნიან.
dsh-იდან გამოყენება
v0.1.1-rc.1-ის DeepSeek ადაპტერი ამ მოდელს ატარებს, ამიტომ განახლების შემდეგ ის გამოჩნდება მოდელის არჩევაში. მილსადენი უკვე იყო: rc.8-მა დაამატა native სურათის მოთხოვნები, სურათის შეყვანა /goal-ისა და /plan-ისთვის, და ფაილებისა და სესიების მითითებები @ მენიუში. მოდელი შემოდის UI-ში, რომელსაც უკვე შეუძლია სურათების მიწოდება.
დანარჩენი v0.1.1-rc.1
- გამოსწორდა განლაგების ხარვეზი, როცა
@მითითებამდე წინ ტექსტს ასწორებთ composer-ში. - რესპონსიული Markdown ცხრილები საუბრებში; პატიოსანი სიზუსტე cache-hit კოეფიციენტებისთვის 99.x% დიაპაზონში; subagent საუბრის ჰედერის ნავიგაცია.
ask_user_question-ის პასუხები იღებს რამდენიმე ხაზს, გადატანით დაShift+Enter-ით ახალი ხაზისთვის.
გაშვების შემდეგ ტემპი დაახლოებით ერთი RC ყოველ ორ დღეში რჩება: rc.7 17-ში, rc.8 19-ში, ეს 21-ში.