中数睿智」共找到 2931 篇相关文章

推荐文章8

拒绝视频生成,深度跃迁提出具身基座模型全新路线

深度跃迁发布世界动作模型 DELE - w0.5,放弃基于视频生成模型的路线,训练时联合学习动作与未来世界表征,推理时移除该表征分支。在真机实验表现超基线,具跨背景泛化能力,为世界模型提供新思路。

机器之心
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参量140亿,总参量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评表现出色。

AI前线
新闻资讯7

GPT-5通过“哥德尔测试”!独创性解决博士生都得花几天时间的开放学问题

最新论文,研究人员让GPT - 5挑战5个未解决的优化猜想,它解出3个,还对一题给出不同有效证明方案。测试题需博士水平研究者花几天完成,研究还“挑衅”了陶哲轩对大模型学能力的印象。

量子位
开源动态8

单卡可跑18万原子!分子模拟的“规模焦虑”该终结了

至知创新研究院UBio团队发布的UBio-MolFM v1.5,是可进行分子动力学模拟的机器学习原子间势函。它在精度和规模上有提升,实测表现优于经典力场,架构、据和训练都有创新,误差降45%,速度提8倍,现已开源。

量子位
算法论文8

Claude团队用Qwen测试全新训练方法

Anthropic最新研究提出训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B大模型失准率大幅下降,还能精简微调据。MSM与对齐微调结合,可提升模型泛化能力。

量子位
算法论文8

RL在Agentic Reasoning的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
产品应用8

“参考生”之王回归:Vidu Q3持续进化,剧张力拉满|甲子光年

近期,AI视频公司生科技的Vidu Q3正式上线参考生视频并全面升级。它能解决视频内容创作痛点,让爆款人设等稳定复现。在榜单上表现出色,经测试在多场景降本增效,提升了视频“剧张力”。

甲子光年
算法论文8

RAG新SOTA,还在5亿条据上跑进秒级,只有它了

本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用超边结构重构据底座,在多跳问答测试表现出色,还能在大规模据下低延迟落地。

机器之心
产品应用8

AI Code要变天了,Meta首个代码世界模型登场!

Meta FAIR推出32B参的代码世界模型(CWM),旨在探索世界模型如何改变代码生成和推理,code和mode已开源。在SWE - bench验证表现优,能与更大规模或闭权重的LLM竞争,还介绍了训练、据集等情况。

PaperAgent
新闻资讯7

特朗普AI计划在GitHub上泄露,网友怒喷用AI代码“治国”!

距离特朗普政府启动联邦政府AI发展计划不到一月,“AI.gov”项目代码库在GitHub泄露。该项目由GSA与TTS小组开发,计划7月4日上线。此次泄漏引发对公共部门过度用AI的不满,也引发网友对工作高层盲目推广AI的吐槽。

AI前线