类LLM机制」共找到 1979 篇相关文章

新闻资讯8

被“网暴”两个月后,Yann LeCun 携最新世界模型杀回!小扎千万美元激励抢人,Meta AI 内部权利之争开始

Meta推出新的“世界模型”V-JEPA 2,可提升AI物理推理能力。它是V-JEPA扩展版,在百万小时视频上训练,能让机器人完成任务。Meta还发布三项基准测试,且已开源。LeCun力挺,小扎为追进度亲自招人才。

AI前线
算法论文7

智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight

LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。

量子位
开源动态8

2w+ star,和claude对着干,牛皮!

Anthropic 给 Claude 生成文字添加水印,方式独特且难去除。`watermarks-remover` 项目应运而生,针对不同水印机制分层处理,兼容多格式文件,有多种安装使用方式,还明确告知能力边界。

开源先锋
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化
新闻资讯8

Fable 5手搓首个CUDA「超级内核」!2.5小时狂飙18.7倍

在GPU算子基准测试KernelBench - Mega中,Fable 5全程纯手搓CUDA,速度狂飙18.7倍,把GPT - 5.5甩开4倍多。它写出史上首个‘超级内核’,2.5小时约55万token完成编写。Anthropic联创称这标志‘RSI循环’开启。

新智元
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。

机器之心
8

刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA

普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。

量子位
算法论文8

TGRS 2025 | FSConv:空域捕结构+频域提细节,即插即用的特征增强神器

红外小目标检测存在目标小、背景干扰大难题,传统卷积易丢失特征信息。TGRS 2025论文提出FSConv模块,通过双域融合提升特征表达能力,具备多尺度特征保持、轻量化、自适应增强等优势,有广泛应用场景。

机器学习AI算法工程
开源动态7

静态技能已死:cognee怎么让AI自己修自己的prompt

文章指出当前agent技能存在silent drift问题,Cognee作为开源知识引擎,将skills视为活的系统组件,通过Skill Ingestion、Observe、Inspect、Amend、Evaluate & Update五步实现自我进化,还介绍了相关应用及社区反应。

AI工程化
算法论文8

ICLR 2026|多模态大模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态大模型迅速发展,但能否理解人情绪存疑,且缺乏系统性评测框架。香港中文大学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心