显著性方法」共找到 1248 篇相关文章

算法论文8

NVIDIA提出小型LLM才是未来,并将重塑Agentic AI

人工智能代理快速渗透企业场景,但当前系统依赖大型语言模型,存在经济成本和效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济和操作适配优势,并给出迁移路径。

深度学习自然语言处理
新闻资讯7

Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估式等,提及与传统工具将长期共存。

Founder Park
开源动态8

字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名

现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害

机器之心
算法论文8

ICLR2025 | LLM为什么能拒绝回答有害问题呢?

该论文首次系统研究注意力头在LLM安全中的作用,提出Ships和Sahara法,在极少参数改动下显著降低模型安全,发现不同模型安全头高度重叠,为理解模型安全机制提供新视角。

深度学习自然语言处理
算法论文8

全新预训练数据筛选案,让数据效率提升10倍!配置仅需fastText评分器|港科大vivo出品

香港科技大学和vivo AI Lab提出轻量级高效数据选择法PreSelect,已被ICML 2025接收。它只需训练部署基于fastText的评分器,减少10倍计算需求,在多数据集实验中效果显著优于其他法。

量子位
新闻资讯7

AI可观测行平台Lightrun,获7000万美元

AI可观测平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众多企业信赖,发展迅猛。

AIGC开放社区
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线增长,此前法难公平比较。团队提出「KV 足迹」指标,改进法并推出 PruLong 优化内存,节省空间且保能。

机器之心
新闻资讯8

经纬领投2000万美元,Aether AI让机器人学会举一反三|甲子光年

6月18日,Aether AI获约2000万美元首轮融资。创始人黄碧薇认为主流大模型学的是相关而非因果,她将LLM和因果算法结合,打造因果世界模型,搭建“因果大脑”,并选择具身智能作为落地场景。

甲子光年
开源动态8

比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷新SOTA

兔展智能与北京大学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用强,能提升其他基础模型能,相关论文、代码和模型已开源。

量子位
算法论文8

清华首提通用大模型滤波法,实现零样本状态估计|NeurIPS'25

清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统法泛化差问题,在未见过系统中实现零样本状态估计,有望成基础模型。

新智元