AI快讯苏晓 2026-01-27 09:23:46 来源:中房网
中房网讯 (苏晓/文)1月26日,阿里推出千问系列旗舰推理模型Qwen3-Max-Thinking。根据阿里公布的数据,该模型在19项权威基准测试中的表现媲美OpenAI的GPT-5.2-Thinking、谷歌的Gemini 3 Pro等国际模型,标志着国产大模型在高阶推理领域实现重要突破。
据悉,该模型总参数量超万亿,预训练数据量达36T Tokens,经大规模强化学习打磨而成。相较于前代模型,其核心改进集中在两方面。
一是自适应工具调用能力,可按需调用搜索引擎和代码解释器,现已上线Qwen Chat。与早期需要用户手动选择工具的方法不同,Qwen3-Max-Thinking能在对话中自主选择并调用其内置的搜索、记忆和代码解释器功能。这种能力让模型能像专业人士一样自主判断是否调用搜索、记忆或代码解释器,比如解答实时政策问题时自动检索最新信息,处理工程计算时启动代码工具验证结果,无需用户额外指令即可降低“幻觉”风险。
而是测试时扩展技术(Test-Time Scaling),指在推理阶段分配额外计算资源以提升模型性能的技术。据称显著提升推理性能,在关键推理基准上超越Gemini 3 Pro。
目前,普通用户可通过千问PC端、网页端免费体验,企业则能通过阿里云百炼获取API服务。