math - 搜索 News

2 小时

LeCun痛批硅谷傲慢病！圈内爆火长文：DeepSeek R1-Zero比R1更重要，成AGI ...

导读：奥特曼罕见地承认了自己犯下的‘历史错误’，LeCun发文痛批硅谷一大常见病——错位优越感。DeepSeek的终极意义在哪？圈内热转的这篇分析指出，相比R1，R1-Zero具有更重要的研究价值，因为它打破了终极的人类输入瓶颈！

18 天

阿里云通义Qwen2.5-Math-PRM：7B模型超越GPT-4o，数学推理新突破

1月16日消息，阿里云通义团队发布了新一代数学推理过程奖励模型——Qwen2.5-Math-PRM。该模型引入了72B与7B两种尺寸，其在推理过程中的表现显著优于现有的开源模型，尤其在推理错误识别方面，7B版本的性能甚至超过了闭源的GPT-4o。这一创新不仅为智能推理提供了新的可能性，也为相关领域的技术进步注入了新的活力。 Qwen2.5-Math-PRM模型的设计旨在解决大型语言模型在处理推理时 ...

17 天

阿里云推出Qwen2.5-Math-PRM模型，7B比GPT-4o更强大

在数学推理领域，阿里云再次震撼科技界，推出了其全新的过程奖励模型——Qwen2.5-Math-PRM。于1月16日发布的这一创新，涵盖了72B及7B两种尺寸，表现显著优于同类开源模型，尤其在推理错误的识别能力上，7B版本竟然超越了广受关注的GPT-4o。

18 天

阿里云通义推出Qwen2.5-Math-PRM模型与首个推理评估标准

在科技快速发展的今天，阿里云再一次为人工智能领域推陈出新。1月16日，钛媒体App报道了阿里云通义开源了全新的数学推理过程奖励模型——Qwen2.5-Math-PRM。这一模型的推出，标志着在72B与7B尺寸下，其性能远超同类开源过程奖励模型。

腾讯网17 小时

DeepSeek到底是真开源还是假开源？业内：有足够多细节值得学习

近日，在国内某问答平台上，一则关于 DeepSeek 的提问登上问题热门排行榜。这一问题的描述是：“如何评价 DeepSeek 自称开源？但似乎并未开源（Open Source），仅为 Open Model?”（来源：资料图）那么，DeepSeek ...

IT之家22 天

微软 rStar-Math 技术登场：小语言 AI 模型数学推理从“不及格”一跃 ...

IT之家1 月 11 日消息，微软亚洲研究院旗下数学和人工智能研究团队昨日（1 月 10 日）发布博文，针对小语言模型，设计并开发了 rStar-Math 技术，专门用于解决数学问题。和微软之前推出的 Phi-4 不同，rStar-Math 采用蒙特卡洛树搜索（Monte Carlo Tree Search）进行推理 ...

17 小时

从特朗普政府“星际之门”到 DeepSeek：是什么在左右全球科技、经济 ...

特朗普政府上任伊始就展现了对AI领域的雄心壮志。1月21日，特朗普在白宫宣布了名为"星际之门"的庞大AI基础设施计划，预计在未来四年内投资5000亿美元，用于建设支持AI发展的基础设施 ...

腾讯网1 天

o3-mini物理推理粉碎DeepSeek R1？全网最全实测来袭

新智元报道编辑：KingHZ 桃子【新智元导读】一场改写AI历史的震撼对决正在上演！就在昨天，当DeepSeek ...

腾讯网17 天

阿里云通义开源全新数学推理过程奖励模型Qwen2.5-Math-PRM

多知1月17日消息，通义千问Qwen宣布开源全新的数学推理过程奖励模型Qwen2.5-Math-PRM，包括72B和7B两个版本，将提升大型语言模型(LLMs)在数学推理过程中的可靠性和可信度，自动识别推理过程中的错误，如计算或逻辑错误，这些错误可能导致不正确的结论，即使最终答案正确，也可能削弱模型推理过程的可信度。在识别推理错误步 ...

8 天

全球掀DeepSeek复现狂潮！硅谷巨头神话崩塌，30刀见证啊哈时刻

就在刚刚，网上已经出现了一波复现DeepSeek的狂潮。UC伯克利、港科大、HuggingFace等纷纷成功复现，只用强化学习，没有监督微调，30美元就能见证「啊哈时刻」！全球AI大模型，或许正在进入下一分水岭。

腾讯网2 天

中国的黑马！DeepSeek何以震动全球AI圈？

在科技浪潮汹涌澎湃的当下，人工智能领域宛如一片充满无限可能的创新海洋，不断涌现出引领时代变革的璀璨新星。其中，DeepSeek（深度求索）以其卓越非凡的技术实力与创新理念，强势闯入全球视野，在 AI 领域掀起了一场轩然大波。那么，这个震动全球 AI ...

中华网7 天

全球掀DeepSeek复现狂潮硅谷巨头神话崩塌！

硅谷正经历由中国公司引发的重大变革。全美都在担忧全球人工智能的中心是否已经转向中国。此时，全球范围内掀起了复现DeepSeek模型的热潮。正如LeCun所说：“这是开源对闭源的一次胜利。”这些讨论引发了人们对数百亿美元支出必要性的质疑，甚至有人预测中 ...

一些您可能无法访问的结果已被隐去。

显示无法访问的结果