「新推理模型」共找到 9766 篇相关文章
数据科学新风口?三大环节搞定ML「资产」管理,VLDB'25最新教程抢先看!
大模型时代,ML资产爆炸式增长,但大多缺乏规范管理。凯斯西储大学等研究团队将在VLDB 2025提出教程,从整理、发现、利用三大环节给出ML资产管理方法论与系统路径,还会展示前沿平台解决实际问题。
【闭门会干货】字节 AI 最新动态:豆包升级+提示词神器+ SOTA 向量模型 + AI知识库 !
作者参加字节火山方舟开发者闭门会,分享诸多AI成果。豆包模型0715版较0615版能力提升显著;PromptPilot工具让提示词优化工程化;还有Responses API、AI知识库等实用工具,且有免费计划。此外,Seed1.6 - Embedding登顶多榜单SOTA,VikingDB升级,平台有协作奖励计划。
蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录
蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用大模型,靠数据、工具、训练方法三大创新实现突破。
能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent
LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。
Claude Code凭什么牛?大模型团队天天用自家产品,发现bug直接就改了
Claude Code虽有争议,但很成功,4个月用户达11.5万。Claude Code负责人透露构建细节,如产品理念、评估标准、反馈机制等,还阐述编程领域变化、模型与工具共同进化等内容。
Nature重磅研究:大模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?
《自然》研究表明,大语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使大脑‘变懒’。需按需调节使用。
京东AI一揽子开源!超多核心项目全开源,GitHub万star项目也有新进展了
京东系统性开源系列AI能力,从大模型到Agent等。JoyAgent 3.0升级,开源DataAgent和DCP模块;OxyGent多智能体框架让开发者自由组合。还有京医千询2.0等,意在推动AI在各行业落地。
GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了
GPT-6 Astra靠Agent一键生成3D内容刷屏后,引发通用大模型是否会取代专业3D生成模型的讨论。本文实测影眸Hyper3D新上线的Agentic Mode,分析3D行业在Agent时代的全新竞争标准。
矩阵乘法新突破!XX^T原来可以更快!RL助力搜索,世界纪录又被提升了5%
深圳市大数据研究院、香港中文大学(深圳)研究团队,结合强化学习与组合优化技术,发掘新算法 RXTX,让 XX^T 运算减少 5% 运算量,成果在国际引发关注,不过产业化落地仍面临挑战。
田渊栋:连续思维链效率更高,可同时编码多个路径,“叠加态”式并行搜索
AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维链提供理论支持。还设计注意力选择器等机制,实验显示连续思维链模型准确率更高。此外,田渊栋还是科幻小说家。