新全栈」共找到 5148 篇相关文章

推荐文章7

对话灵感实验室:帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型

InfoQ对话格灵深瞳灵感实验室,探讨多模态大模型下视频理解问题。指出传统视频模型抽帧处理浪费算力和信息,介绍LLaVA - OneVision - 2.0突破长视频理解瓶颈,还提及“视觉智能工坊”助力业务落地。

InfoQ
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安问题了!

作者深度使用AI Agent时担忧其安性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
开源动态8

龙虾冲浪终于不迷路了!网页智能体框架Avenir-Web开源即SOTA

伦敦大学学院等团队推出开源框架Avenir - Web,解决现有Web Agent在复杂网页操作中的难题。它采用模块化设计,包含经验模仿规划等模块,在ONLINE - MIND2WEB测试中表现出色,已开源供开发者探索。

量子位
8

网最强万字解读:DeepSeek-V4 掀翻了谁的桌子? | GAIR live 030

文章深度解读了DeepSeek-V4,从产业、生态和架构维度拆解其效率账本。它成本低,补齐短板适配昇腾芯片,但极致省钱也有代价,如性能衰减、架构复杂等。还探讨了长上下文、MoE与稠密模型路线差异及商业化潜力。

AI科技评论
算法论文8

从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成范式

在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 方法,通过景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。

机器之心
算法论文8

头号玩家照进现实!NTU发布世界模型交互范式,攻克主动操作难题

南洋理工大学MMLab团队推出Hand2World,让AI世界模型能真正互动。它摒弃旧有遮挡误导,用3D手部结构与射线编码解耦手与头运动,实现闭环持续交互,基于单目视频自动标注,为AR、机器人交互铺路。

新智元
算法论文8

让机器人学会手往哪儿伸、怎么操作,东大团队给了解法

东南大学魏秀参团队提出 RAAP 解决具身智能领域可供性预测难题。它将 affordance 分解,设计互补推理机制,每任务仅需数十样本,已被 ICRA 2026 接收,实验显示其性能优于基线。

机器之心
新闻资讯7

林俊旸离职后首次发声!复盘千问的弯路,指出AI的

林俊旸离职阿里千问后发声,反思千问技术路线,认为千问合并两种模式未做好。他指出推理时代已过,未来是智能体时代,智能体思考将成主流,还阐述了其与推理思考区别及面临的挑战。

量子位
新闻资讯8

Agent重塑软件与互联网产业范式,2026奇点智能技术大会初版日程出炉!

4月17 - 18日,CSDN与奇点智能研究院联合举办的「2026奇点智能技术大会」将在上海举行。大会云集顶尖机构与企业一线AI实践者,围绕前沿议题分享,还将首发《AI原生软件研发成熟度模型(AISMM)》白皮书。

AI科技大本营
新闻资讯7

从「北纬社区龙虾大赛」到「中关村论坛人工智能主题日」:海淀AI的叙事

3月22日「中关村・北纬龙虾大赛决赛」举办,展现AI走向「生活化」场景。3月25 - 29日将进行「第三届中关村论坛人工智能主题日系列活动」。海淀京张遗址公园AI创带串联多方资源,推动AI发展,北京正构建城市级AI操作系统。

机器之心