多图案掩模版」共找到 4110 篇相关文章

开源动态8

腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有个核心亮点和典型应用案例。

量子位
新闻资讯8

谷歌前CEO深度专访:AI、智能体会重塑世界

谷歌前CEO Eric Schmidt在Ted专访中,从AI起点AlphaGo说起,阐述其从大模型到自主决策智能体的发展,还提及算力电力需求增长、监管、开源等问题,虽挑战,但他对AI重塑世界充满信心。

AIGC开放社区
开源动态7

谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!

当地时间6月23日,Linux基金会宣布与公司成立A2A项目,由谷歌捐赠协议规范等。A2A是谷歌4月推出的开放标准,支持智能体通信协作。有开发者认为它或削弱MCP地位,但谷歌称是其“补充”。实际应用有诸问题待解。

AI前线
新闻资讯8

梁文锋,Nature全球年度十大科学人物!

权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有位其他领域人物因各自成就上榜。

量子位
新闻资讯7

The Batch: 880 | 用 AI 学 2 小时 vs. 跟老师学 6 小时

Alpha School用AI驱动教学,将传统6小时课程替换为2小时个性化学习,让学习速度翻倍,学生考试成绩优异。但部分教育委员会拒绝其分校申请,批评者称缺乏严格证据。此外,美国地也在进行AI教育尝试。

DeeplearningAI
推荐文章7

图解Vllm V1系列7:使用AsyncLLM做异步推理

文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及请求并发及构建异步推理引擎思路。

GiantPandaLLM
算法论文8

破解遥感目标的形状与尺度难题,PKINet二代推理提速近4倍!

PKINet - v2是改进的遥感目标检测模型,能处理复杂形状和尺度变化问题。它在PKINet基础上升级,统一条带与方形卷积,部署时折叠为单大核。在数据集上精度和速度提升,可服务领域,但对特殊目标仍有检测问题。

新智元
产品应用8

昨天夸国产大模型争气,今天Vidu Q3就霸榜了

国产视频大模型Vidu Q3在国际权威AI基准测试机构Artificial Analysis的最新榜单里,于Video Arena冲到全球第二、国产第一。它是全球首个支持16秒音视频直出模型,声画同出、高清直出,还有镜头控制、语言文字渲染等优势。

MacTalk
开源动态7

Container Use:一种用于独立的并行编码代理的新工具

Dagger团队发布开源工具Container Use,为AI编码代理提供容器化沙箱和Git工作树,实现无冲突并行工作流。它能创建隔离开发环境,让开发者在同一代码库安全运行代理。不过该工具尚处早期,有不足。此外还介绍了其他类似工具。

InfoQ
开源动态8

超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦

中科院与字节联合提出「GAR」,为构建自然图像的Dense Caption提供新思路。GAR具备精准描述、关系建模和组合推理能力,通过引入新组件,兼顾细粒度与全局上下文,在测试集表现优异,且代码等已开源。

量子位