长上下文场景」共找到 2965 篇相关文章

算法论文8

超越 VTM-RA!快手双向智能视频编码器BRHVC亮相NeurIPS2025

视频编码中双向编码潜力待挖掘,快手音视频技术团队提出BRHVC方法,解决跨度帧运动处理和参考贡献不平衡问题,其成果被NeurIPS 2025录用,在压缩性能上超越VTM - RA编码。

机器之心
产品应用7

2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接」

作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同时探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。

特工宇宙
算法论文8

谢赛宁盛赞字节Seed新研究!单Transformer搞定任意视图3D重建

字节Seed康炳易团队的最新研究成果Depth Anything 3(DA3),获谢赛宁盛赞。它架构简单,能从多种输入中精准算出物体深度、还原相机位置,在新视觉几何基准上表现出色,核心秘诀是极简设计。

量子位
开源动态8

Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统

Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。

AI工程化
推荐文章7

Claude Agent Skills:从第一性原理深入剖析

本文深入剖析Claude的Agent Skills系统,它是基于提示的元工具架构,借助‘提示展开’与‘上下文改写’扩展大模型能力。文中以具体技能为例,介绍其机制、构建方法、编写规范及常见模式。

PaperAgent
新闻资讯7

Visual Studio 正式支持 MCP

2025年8月微软宣布模型上下文协议(MCP)在Visual Studio正式可用,为AI智能体与外部工具连接提供一致协议。开发人员可配置文件连接,管理员能管理使用。但存在限制和安全风险。

InfoQ
开源动态8

大模型优秀大脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup

10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中大咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。

机器之心
算法论文8

世界模型==VQA?机器人不用想象画面,预测语义就够了

华盛顿大学、索尼AI研究者在新论文中质疑机器人世界模型是否需想象精确未来画面。指出多数模型还原画面不适合决策,提出语义世界模型SWM,能预测未来语义信息,实验效果良好。

机器之心
推荐文章8

2025甲子Cool Vendor人形机器人大模型领域报告 | 甲子光年智库

甲子光年智库发布《2025甲子cool vendor人形机器人大模型领域报告》。当前人形机器人产业迎来关键转折点,产业链层级完整,大模型解决落地难题,应用场景升级。报告还呈现了产业链现状与趋势。

甲子光年
产品应用8

刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程

Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。

AGI Hunt