ThinkLLM
ModelsCapabilitiesUse CasesBenchmarksPapersGlossary
ModelsCapabilitiesUse CasesBenchmarksPapersGlossary
AboutPrivacyTermsRSS

ThinkLLM

Spot an error in our data? Let us know.

Papers

Recent AI research papers with accessible summaries. Updated daily from arXiv, summarized for developers who don't read papers regularly.

2567 papers12 topics
AllTraining 46Reasoning 42Efficiency 33Evaluation 32Agents 27Architecture 18Multimodal 17Applications 16Data 9Safety 9scaling 5Alignment 2

Jul 15 – Jul 21, 2024(1)

Qwen2 Technical Report

Jul 15, 2024

An Yang, Baosong Yang, Binyuan Hui

Alibaba produced a globally competitive open model family — Qwen2 demonstrated that Chinese AI labs can match Western frontier models across languages.

Describes Qwen2, a family of models from 0.5B to 72B trained on 7T tokens across 27 languages. The 72B model matches Llama 3 70B while excelling on multilingual and code tasks.

scalingtrainingmultilingual