长思考能力」共找到 4079 篇相关文章

算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
推荐文章7

分享2个模型省钱大法

文章分享两个大模型API省钱技巧。一是文本转截图,适用于输入输出短、费用花在输入token的任务;二是音频加速识别,OpenAI语音识别模型Whisper按音频时收费,加速音频可省钱,还可包装成API服务盈利。

AGI Hunt
开源动态7

4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!

高人气开源智能体记忆项目Mem0在论文中称在LOCOMO上打败所有人,MemGPT联合创始人公开指控其测试无意义、数据造假。二者都为解决大模型期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。

AI前线
7

对谈黄灯:普通二本学生的出路在哪里?

高考季,与《我的二本学生》作者黄灯对谈二本学生出路。指出学历非唯一,能力和热情更重要。当下就业严峻,高校课程与社会需求脱节,二本学生应提升动手能力,利用AI工具,立足学校和当地找机会。

乱翻书
产品应用7

企业微信给AI写了94份说明书,Claude Code现在能直接干活

北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。

AI Reading Hub
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
算法论文8

破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”

语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力

量子位
新闻资讯7

才知道百度和阿里为什么能联手瓜分市场了

AI热度未减但问题转变,企业更关注全栈能力。沙利文报告显示2025年上半年阿里云和百度智能云占一站式AI云市场超一半。阿里和百度期投入,全栈能力让其在竞争中更笃定,苹果也选它们为中国AI伙伴。

MacTalk
算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
推荐文章7

扩散语言模型深度思考

作者探讨扩散语言模型(dllm),认为其建模方式或冲击AR。团队在AAAI报告介绍多项工作,还整理当前diffusion问题及观点,如推理架构、词表、优化范式等,并附项目网站和agent demo。

机器之心