升級(jí)版DeepSeek-V3模型開(kāi)源!DeepSeek上可試用體驗(yàn)快訊
DeepSeek在開(kāi)源平臺(tái)上線了升級(jí)后的DeepSeek-V3模型,//huggingface.co/deepseek-ai/DeepSeek-V3-0324 同時(shí)DeepSeek也將DeepSeek-V3模型的開(kāi)源協(xié)議更新為與DeepSeek-R1一致的MIT協(xié)議,DeepSeek于2024年12月26日發(fā)布了DeepSeek-V3 首個(gè)版本。
【TechWeb】3月25日消息,DeepSeek在開(kāi)源平臺(tái)上線了升級(jí)后的DeepSeek-V3模型。新模型的版本號(hào)為DeepSeek-V3-0324,模型參數(shù)為6850億,其早期版本參數(shù)為6710億,相比有小幅增長(zhǎng)。
開(kāi)源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324
同時(shí)DeepSeek也將DeepSeek-V3模型的開(kāi)源協(xié)議更新為與DeepSeek-R1一致的MIT協(xié)議,這一協(xié)議允許模型蒸餾、商用等行為,給了開(kāi)發(fā)者更多的自主權(quán)。
DeepSeek在其官方交流群中稱,DeepSeek V3模型已完成小版本升級(jí),歡迎前往官方網(wǎng)頁(yè)、App、小程序試用體驗(yàn)(關(guān)閉深度思考),API接口和使用方式保持不變。
從網(wǎng)友初步反饋的實(shí)測(cè)效果來(lái)看,V3編碼能力已經(jīng)接近 Claude3.7,在網(wǎng)站開(kāi)發(fā)能力、UI設(shè)計(jì)方面展現(xiàn)出巨大的進(jìn)步,數(shù)學(xué)能力也有提升,能像推理模型一樣解題。
DeepSeek于2024年12月26日發(fā)布了DeepSeek-V3 首個(gè)版本,當(dāng)時(shí),該版本的DeepSeek-V3 多項(xiàng)評(píng)測(cè)成績(jī)超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他開(kāi)源模型,并在性能上和世界頂尖的閉源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)
1.TMT觀察網(wǎng)遵循行業(yè)規(guī)范,任何轉(zhuǎn)載的稿件都會(huì)明確標(biāo)注作者和來(lái)源;
2.TMT觀察網(wǎng)的原創(chuàng)文章,請(qǐng)轉(zhuǎn)載時(shí)務(wù)必注明文章作者和"來(lái)源:TMT觀察網(wǎng)",不尊重原創(chuàng)的行為T(mén)MT觀察網(wǎng)或?qū)⒆肪控?zé)任;
3.作者投稿可能會(huì)經(jīng)TMT觀察網(wǎng)編輯修改或補(bǔ)充。