多场景支持」共找到 5940 篇相关文章

开源动态8

手机操控革命!开源手机AI Agent,自然语言操控Android/iOS!

传统移动设备自动化工具难实现自然语言控制和跨应用交互,开源项目Mobile - Use提供解决方案。它由Minitap AI开发,能通过自然语言指令实现设备UI感知自动化,功能丰富,应用场景广。

开源星探
产品应用8

谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%

昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有种玩法,上线后测试火爆,在个榜单成绩优异。

机器之心
新闻资讯7

清北浙领跑两院新院士候选!最年轻被提名人39岁

8月20日,中科院和工程院公布2025年院士增选有效候选人名单。清北浙领跑,最年轻候选人39岁。人工智能地位提升,机器人技术成优先支持学科,反映国家对新兴领域的重视。

量子位
新闻资讯7

GPT-5 最强大的,是编程

据报道,OpenAI的GPT - 5即将到来且早期反馈积极。它在编程领域表现突出,尤其在实际编程任务上有提升,不过其具体形式存疑,改进或来自后训练阶段的强化学习。

AGI Hunt
新闻资讯7

HF Papers 直播| AI for Science 专场

由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第三场聚焦AI for Science,将于2025年7月17日19:30 - 21:30开始。邀请位热门论文作者,探讨科研智能体能力评估等问题。

Hugging Face
算法论文8

一篇95页最新80种Deep Research系统全面综述

浙大研究深度研究系统领域,分析自2023年以来80个实现,提出4维度分层分类法,全面分析4种实现架构,涵盖基础模型、工具利用、任务规划、知识综合等方面的演变与进步。

CourseAI
8

仅2G内存可跑,刚刚,谷歌开源Gemma 3n,端侧原生模态!

谷歌全面发布Gemma 3n,将模态AI功能带入边缘设备并在Hugging Face开源。它原生支持模态输入输出,针对设备端优化,内存占用低,采用开创性架构,Gemma系列质量也不断突破。

PaperAgent
新闻资讯7

AI Pin 们折戟后,第二代 AI 硬件闷声发了大财

过去两年,第一代AI硬件喊出‘杀死智能手机’口号,赚足目光。当下,创业者不再将取代手机作为目标。第二批AI硬件‘边界感’强,专注细分场景,同时,科技巨头正布局全新AI层,‘隐形OS’雏形已现。

Founder Park
开源动态8

模态LLM超越YOLOv3!强化学习突破模态感知极限|开源

华中科技大学、北京邮电大学等所高校研究团队共同推出纯模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。

量子位
开源动态8

SGLang 中的 CUDA Graph 进阶指南

本文介绍 SGLang 构建 CUDA Graph 支持及改动。如 Runner/Backend 解耦与灵活组合;首创 Breakable CUDA Graph 并开源,能提高捕获灵活性;还实现 Prefill 的 Full CUDA Graph,同时介绍显存管理方法。

GiantPandaLLM