具身场景」共找到 2737 篇相关文章

算法论文8

LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收

LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。

机器之心
推荐文章7

从BM25到Multi-Vector:6种Embedding演进路线

文章介绍从BM25到Multi - Vector的6种Embedding演进路线,涵盖Sparse、Dense等类型,分析其痛点、效果、案例及选型建议,还给出不同场景的方案选择和步骤。

PaperAgent
推荐文章8

AGI 投资清单:为什么这 30+公司值得关注?|Best Ideas

今年 AI 进入‘业绩兑现期’,市场看重真实效益和收入。文章围绕技术、资本开支和宏观趋势筛选 30+ 公司,覆盖多领域,分析各公司优势与投资价值,为投资者提供参考。

海外独角兽
开源动态8

1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!

在文本转语音(TTS)领域,生成长篇、多说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还备高效处理长序列等亮点特性。

开源星探
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
新闻资讯8

含全文!OpenAI发布GPT-5官方Prompt指南

OpenAI 发布《GPT-5 prompting guide》,介绍新模型变化及使用方法。新增 `reasoning_effort` 和 `verbosity` 参数,还有 Responses API。Cursor 分享实战心得,同时提及控制 Agent 积极性、解决指令冲突等内容。

AI工程化
算法论文8

追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%

中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。

机器之心
新闻资讯7

Windsurf 的甩卖对 AI 编程生态意味着什么?

Windsurf八个月内ARR达8200万美元,却被低价甩卖。其负利润率高,靠烧钱补贴成本,面临API成本高、竞品低价冲击等问题。此事件揭示编程工价值捕获难,凸显基础设施等环节价值。

宝玉AI
产品应用7

这个 AI 浏览器让我极度舒适,Dia 劲敌没错了

今年多款AI浏览器入局竞争,如Dia、Edge等。最近体验Perplexity Comet浏览器,它与Dia路子不同,主打自然语言操作。AI浏览器或成AI Agent主战场,但功能趋同,创新待现。

MacTalk
产品应用7

Cursor 0.50 版本升级后如何省钱又高效?一份给开发者的避坑指南

本文围绕Cursor编程助手日常应用展开,讲解计费机制、工调用等核心要点,结合实践给出高效使用方法论与避坑指南,如合理选模型、巧用工、设置规则等。

阿里云开发者