领域特定任务」共找到 3685 篇相关文章

算法论文8

综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能

大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。

深度学习自然语言处理
新闻资讯8

颠覆医学!AI帮助无精男喜当爹,800万扫描找出3个生命火种

全球著名媒体CNN消息,一对饱受18年不孕不育折磨的夫妇,在哥伦比亚大学生育中心用STAR方法,靠AI在精液样本中找到3个精子助妻子受孕。STAR由该中心团队耗时5年研发,为患者提供新选择。

AIGC开放社区
新闻资讯8

谷歌AI将攻破200年数学难题!39岁天才率队密研三年,或摘千禧年大奖

谷歌DeepMind携手39岁数学天才Javier Gómez Serrano,率20人团队秘研三年,借AI冲击千禧年大奖难题——纳维 - 斯托克斯方程,预计未来12 - 18个月取得成果,若成功将助人类深入理解多领域机制。

新智元
新闻资讯7

具身智能创业来了位浙大博导,机器人会飞,VC抢着投

具身智能领域,常见机器人多在地面作业。现微分智飞推出会飞的具身智能机器人,由浙大博导高飞创办。其与传统无人机不同,有自主决策能力。公司有行业和教育两条产品线,专注产品技术闭环。

量子位
算法论文8

推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限

大语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
推荐文章7

揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估

文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。

阿里云开发者
开源动态8

腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配

音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。

开源星探
新闻资讯7

产业服务 | AI数智文创,谱写文旅新篇章—北京AIGC视听产业创新中心·创投会(第二期)圆满成功

北京AIGC视听产业创新中心·创投会(第二期)近日落幕。活动汇聚业内企业、院校、专家等,搭建三维平台征集项目。入围项目涵盖多领域,还有特别分享。活动推动AI与文旅融合,为产业发展提供支持。

郎园Station
开源动态8

AI操作有了“紧急刹车”!通义&自动化所AI决策诊断模型,GUI智能体纠错正确率SOTA

阿里通义实验室与中科院自动化所推出GUI - Critic - R1模型,能在GUI智能体操作执行前诊断决策,避免错误。介绍了其动机、方法、数据集及实验,证明该模型在生成判断和提建议方面有效。

量子位
开源动态8

MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀

MiniMax正式开源首个推理模型M1,原生支持百万级上下文长度,在推理效率、计算成本和复杂任务能力上有独特表现。其在性能和效率上超越DeepSeek R1等模型,还提出创新强化学习算法。

AI科技大本营