音乐大模型」共找到 9162 篇相关文章

产品应用7

Cursor发布首个编程模型!代码生成250tokens/秒,强化学习+MoE架构

Cursor 2.0正式发布,搭载自研模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。

量子位
新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位
算法论文8

多模态模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!

近年来,生成式AI和多模态模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。

机器之心
算法论文8

ICML 2026 | 只用少量Thinking Tokens,模型依然能深度思考

近年来,CoT 推理成为提升模型复杂问题求解能力的重要路径,但带来效率问题。浙江学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。

机器之心
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

来自中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

推理路径的动态调控:让模型学会“恰到好处”的思考

当前模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
新闻资讯7

Anthropic最强网络攻防模型Mythos,美国国安局早就一直在用了

美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。

新智元
新闻资讯7

模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
新闻资讯7

征集全国首部AI模型私有化部署标准起草单位和个人!

智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准正式立项,这是国内首部相关标准。它全流程覆盖、多方面融合、三方协作,现正征集起草单位和个人。

机器学习AI算法工程
开源动态8

一键检测你的电脑能跑哪些模型,这项目6!

介绍工具`LLMFit`,它用Rust编写,能自动检测硬件配置,判断模型能否流畅运行,还可推荐最优量化版本和运行模式。该项目在Github获5.9k+ star,有多种安装方式。

开源先锋