爆破性研究」共找到 2310 篇相关文章

算法论文8

LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高

这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的能。

机器之心
算法论文8

迈向长程智能体,人大高瓴发布149页全景综述

新问题出现,长程智能体研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能体统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。

机器之心
算法论文8

链式思维是幻象吗?从数据分布视角重新审视大模型推理,马斯克回复,Grok破防

亚利桑那州立大学研究发现,思维链(CoT)推理可能只是对训练数据分布内模式的复现,输入与训练数据分布有差异时,推理链条会失效。研究探究了CoT泛化等问题,对实际应用提出警示。

机器之心
算法论文7

刚刚,OpenAI前CTO:战胜LLM不确定的方法找到了!

OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定》。研究指出LLM推理不确定主因是批处理大小变化,而非常见认为的GPU并行等。还给出实现批处理不变的方案及实验结果。

PaperAgent
新闻资讯7

苦研10年无果,千万经费打水漂!AI黑箱依然无解,谷歌撕破脸

ChatGPT「舔狗化」暴露AI缺乏可解释,谷歌和Anthropic就「机制可解释」产生争论。谷歌DeepMind不再将其作研究重点,Anthropic则主张重视。十多年研究成果有限,或应采取「自上而下」研究方式。

新智元
新闻资讯7

刚刚,Anthropic 成立了个 AI精神病学团队,正在招人

Anthropic宣布成立「AI精神病学」团队,作为可解释研究一部分,将研究模型人格、动机等致其行为异常的因素。团队现正招聘研究科学家,不过此举措也引发争议。

AGI Hunt
新闻资讯8

Claude深夜更新!DeepResearch+MCP入侵你的私人数据,威力很大!

Anthropic宣布Claude的「Integrations」集成功能和「Advanced Research」高级研究能力两项更新,改变人与AI交互方式。集成功能可连接多种应用,高级研究能力增强了搜索研究能力,这些更新标志着AI助手向工作伙伴转变。

AGI Hunt
新闻资讯8

Nature发表、Science点赞!清华揭秘AI让科学家走捷径却让科学走窄路

清华大学基于超4100万篇论文研究发现,AI虽提升科学家个人产出与职业进程,却使科学探索领域变窄固化。研究发表于Nature,被Science深度报道,揭示了AI在科学发展中的利弊。

AIGC开放社区
产品应用8

这个国产Deep Research 有些「另类」:它不想只授你以鱼,还想授你以渔

文章介绍秘塔AI的Deep Research产品,它有“问题链”展示,研究过程可视化,免费开放。实测中它表现出色,能深度分析问题、给出有价值结论。虽有小瑕疵,但在深度研究赛道领先,让AI思考透明、研究普惠。

AGI Hunt
算法论文8

多模态后训练反常识:长思维链SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心