「多任务处理」共找到 5816 篇相关文章
DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%
特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。
狂揽15.9K star!!Win系统居然还有开源替代版,牛逼啊~
开源君分享开源项目`ReactOS`,它类似Windows,目标是与NT系列无缝兼容,可直接运行Windows软件和驱动。该项目始于1996年,在Github获15.9K star,有轻量、兼容等特点,安装简单。
智源新出OmniGen2开源神器,一键解锁AI绘图「哆啦 A 梦」任意门
2024年9月智源研究院发布统一图像生成模型OmniGen,获社区好评。近期OmniGen升级为OmniGen2,增强多方面能力且全面开源。它采用新架构与策略,有反思机制,玩法丰富,还推出新基准优化部署。
美团提出首个语音交互GUI智能体,端到端语音训练能力优于传统文本训练
美团和浙大联合推出GUIRoboTron - Speech,这是首个能利用语音指令和屏幕截图端到端决策的自主GUI智能体。它解决了文本依赖问题,团队经多步骤研发,其性能评估表现佳,还给出招聘信息。
2025谷歌研究学者计划名单:吴佳俊、Mamba作者Albert Gu、Tri Dao等获奖
本周四,2025年谷歌研究学者计划获奖名单公布。该计划为鼓励与科研人员合作、推动科技进步而设,申请人需为高校教职人员,获奖者最高可获6万美元奖金。本文列出了部分获奖华人学者信息。
有一说一,老周还真的挺懂 Agent 的
360 AI 发布会,老周回应市场部一事,称是让员工养成用 AI 习惯。他懂 Agent,认为其将成 AI 应用标准形态,360 从搜索切入,推出纳米 AI 超级搜索智能体,还发布两款 AI 硬件。
谷歌CEO劈柴震撼预言:2030年AI直逼超人智能,80亿人认知被颠覆
谷歌CEO劈柴在采访中称AI是人类历史上影响最深远的技术,进步极快且能力上限未知。他谈到AI会释放80亿人认知潜能,还从多方面阐述了AI对各领域的影响及未来发展。
ICML 2025|趣丸研发新型人脸动画技术,声音+指令精准控制表情
广州趣丸科技团队提出新颖肖像驱动框架Playmate,能根据音频和控制条件生成高质量肖像视频,精准控制表情和姿态。成果被ICML 2025收录,代码开源筹备中,在多方面优于现有方法。
机器人学会「眼看手摸」!FreeTacMan 实现人类指尖亲自「授课」
OpenDriveLab提出的FreeTacMan,将人类视觉、触觉和动作技能高效传输给机器,破解精细操作难题。它配备高分辨率触觉“皮肤”,实现人类“手把手”教机器人“感知”,还通过融合时间感知的触觉预训练,提升机器人策略性能。
谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。
谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。