9 月 16 日,消息源 @lyraxana 在 X 平台发文披露,谷歌正在开发一款内部代号为 Mathematica 的实验性 AI 模型。该模型基于 DeepThink V3 架构构建,面向繁重计算与复杂符号问题求解进行专项优化,外界预估它将成为谷歌目前数学推理能力最强的模型。
从 API 层面获取的信息看,该模型的内部标识符为“models / deepthink-mathematica-tf-raw-thoughts”。其上下文窗口可达 100 万个词元(token),单次输出上限为 65,536 个词元。
IT之家注:上下文窗口指模型单次处理时可读取的文本单位总量;输出上限指模型单次回答可生成的文本单位数量。
泄露的配置信息中,该模型被标注为“UNSTABLE_EXPERIMENTAL”,即不稳定实验版本;同时还带有“Teamfood”标签——这是谷歌内部用于员工测试的术语,说明相关服务目前仍处于内部测试阶段。
TestingCatalog 补充道,谷歌此前已上线面向高阶数学竞赛的 Gemini DeepThink IMO 模式,并于 9 月 15 日推出了 Gemini 3.8 Live 与 Live Extended Thinking。





