「有监督微调」共找到 6465 篇相关文章

推荐文章7

诺基亚坟墓里,埋着半套战胜美国的密码本

文章回顾诺基亚兴衰史,从濒临破产到成为全球手机霸主,后被苹果等超越。其崛起得益于市场机制、人才红利等;失败因利益分配失衡致盟友倒戈。这对中美科技竞争有启示,重塑利益格局很关键。

芯师爷
算法论文7

模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。

深度学习自然语言处理
新闻资讯7

Poe:DeepSeek使用率下降50%,快手崛起、OpenAI暴涨

2025年春季,Poe发布AI模型使用趋势报告。DeepSeek使用率降超50%,OpenAI因文生图功能暴涨。文本、视频、推理、图像和音频5大领域中,各模型表现不一,如快手Kling家族、谷歌Imagen 3家族等有亮眼表现。

AIGC开放社区
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
算法论文8

TreeHop:无需LLM的高效多跳问答新范式

多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。

深度学习自然语言处理
产品应用8

全球首个通用决策大模型,AI推演现实世界的技术揭秘

中科闻歌决策机Decitron被称为「全球首个通用决策大模型」,它将不同能力统一到开放世界决策框架,形成闭环。8月3日其技术报告发布,公开三项核心技术,还介绍了推演流程和实验验证情况。

机器之心
新闻资讯7

十四年的「管家」局,科沃斯这回把应用定义权交了出来

2026年世界机器人大会上,科沃斯董事长钱东奇提出「未来应用,由用户定义」。回顾过去,从2012年推「亲宝」到2026年发布「八界」,其发展有迹可循。当前,科沃斯推出创新方案和开源生态欲破具身智能难题。

机器之心
推荐文章7

完全相信 AI 代码的 Uncle Bob,坦诚这条路还没走通

在AI代码普及当下,Uncle Bob放弃人工评审代码,搭建管控框架引争议,Grady Booch反对,认为AI无法替代资深工程师。Uncle Bob设强约束体系,虽有成效但自动化架构规划未达理想,还给出开发建议。

AI前线
推荐文章7

越靠经验思考的岗位,越先被取代!OpenHex董舒:AI数字员工正在催生OPC一人公司

OpenHex董舒认为AI最大价值是替人出面干活,提出数字员工概念。他指出判断力密度高的岗位易被AI取代,中国服务业有发展机会。还辨析数字员工类型,介绍其平台OPS Agent,最后分享了数字员工相关Q&A。

AI科技大本营
产品应用8

突发!Claude挑战黎曼猜想「失败」,却意外刷新37年数学纪录

AI向黎曼猜想发起挑战,Anthropic的Claude研究版本虽未攻克该猜想,但将黎曼ζ函数中已知至少位于临界线上的零点比例下界,由41.6%提高到了67.2%,这可能是解析数论领域重大进展。

机器之心