图像和视频换脸」共找到 7624 篇相关文章

算法论文8

ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE

长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。

机器之心
开源动态8

浙大联合北大开源 Easel:一个 Agent 包办社媒全链路,从热点发现到多平台发布!

浙江大学北京大学联合开源Easel,这是面向社媒创作者的内容工作台,用一个Agent打通全链路,有画像驱动等六大亮点,还给出清晰的快速上手流程。

开源星探
开源动态7

还是你们会玩,2.9k Star OpenBiliClaw

OpenBiliClaw把浏览器扩展等拼成内容发现Agent,将内容推荐主导权交回用户。它汇总显式授权来源信号找内容,形成本地画像。介绍其架构层级、核心闭环,也提醒“本地优先”仍需做隐私检查。

小华同学ai
推荐文章8

Karpathy又封神!掀翻RAG,把你的笔记变成第二大脑

前OpenAI创始成员Andrej Karpathy提出让大模型把笔记「编译」成持续生长的活Wiki,替代RAG。他将笔记当源代码,LLM当编译器,实现知识结构化。此方案降低维护成本,解放人类注意力。

新智元
新闻资讯8

刚刚,美国AI霸主换了!Anthropic年收300亿,碾压OpenAI

外媒披露Anthropic年化营收达300亿美元,超越OpenAI的240亿。Anthropic由OpenAI前员工创立,15个月营收翻30倍,训练成本仅为对手四分之一。其80%收入来自企业端,而OpenAI陷入‘增收不增利’怪圈,内部也矛盾重重。

新智元
新闻资讯7

让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!

人工智能下半场聚焦‘行动’,Agent Skill成关键桥梁。为推动AI落地,AIGC开放社区与算泥社区联合主办Agent Skill开发者大赛,设双赛道,官方提供支持,有丰厚奖励,报名通道已开启。

AIGC开放社区
算法论文8

让LLM互相“审稿”:简单的LLM Collaboration/Ensemble方法实现7%性能提升

文章提出LLM-PeerReview方法,受学术同行评审启发,含评分、推理、选择模块。采用‘翻转三元评分技术’减少偏差,实验显示该方法超单一LLM及LLM Ensemble基线,性能提升显著。

AI前线
开源动态8

AI版权侵权难以“定罪”?Copyright Detective:首个集成多范式检测的交互式版权取证系统

随着生成式AI广泛应用,版权纠纷成AI领域棘手挑战。张登辉等研究人员推出Copyright Detective系统,集成多范式检测,解决单一检测局限,为大模型文字版权风险提供全方位“体检”方案。

深度学习自然语言处理
新闻资讯7

GPT-5.4意外泄露!OpenAI最新模型瞄准这2大能力突围

GPT - 5.4疑似泄露,此前在OpenAI编码助手、GitHub代码拉取请求等多处有踪迹。传闻其将搭载200万Tokens上下文窗口,具备像素级精准视觉分析能力,不过也可能是炒作,网友关注其准确率。

量子位
开源动态8

开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B

长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。

机器之心