大语言模型快速演进:DeepSeek-V3.1融合推理,闭源与开源并存

2026/7/23news

大语言模型(LLM)已成为现代人工智能发展的基石,标志着机器学习史上的根本性转折。随着生成式AI的蓬勃发展,LLM的能力已从基础的文本生成、情感分析等自然语言处理任务,拓展至智能体工程与复杂推理。例如,2025年8月发布的DeepSeek-V3.1便是一个混合推理模型,它将DeepSeek-V3与DeepSeek-R1合二为一,支持标准推理与思维链推理的可配置运行,并于同年10月进行了更新。这种快速演进迫使开发者不断迭代模型以适应需求,部分LLM已专门针对代码生成或视觉语言任务进行定制。当前,LLM生态呈现闭源与开源并存的格局。闭源模型通常只能通过开发者平台或专有API访问,其参数规模与训练细节多被视为商业机密。然而,闭源模型长期占据前沿地位更多是行业历史现状的反映,并非其相对开放模型具有内在优越性。在闭源阵营中,Anthropic基于“宪法AI”原则开发的Claude系列表现突出,其中Claude 3.7 Sonnet于2025年2月发布,上下文窗口达20万词元,支持多模态输入;OpenAI的GPT系列同样备受关注,GPT-4o及GPT-4o mini分别于2024年5月和7月推出,具备12.8万词元上下文窗口及多模态输入输出能力。随着技术不断演进,组织需根据特定用例,在日益丰富的模型列表中精准选择以满足自身需求。