多任务」共找到 5333 篇相关文章

开源动态8

基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁

腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出方面展望。

量子位
产品应用8

黑科技来了!无需联网,WIFI信号让你无处遁形!

WiFi DensePose利用WiFi信号,无需联网、摄像头和穿戴设备,通过分析信道状态信息扰动,实现人体姿态估计、生命体征监测和存在检测。它有种特性,适用于医疗、零售、工业等场景。

GitHubStore
开源动态8

Google 开源 gws!一天暴涨 10K+ Star,把整个 Google Workspace 搬进终端。

Google 开源命令行工具 gws (Google Workspace CLI),一天揽 10K+ Star。它动态构建命令界面,支持 Google Workspace 众服务,兼顾人类与 AI 代理需求,还具备灵活认证等亮点,为 Workspace 自动化带来新可能。

开源星探
算法论文8

警告:你的Agent可能无法"解决"真实世界的视觉问题

文章提出 AgentVista 评测基准,含 209 道任务,横跨 7 大领域 25 个子方向。评测 14 个主流模型,最强的 Gemini - 3 - Pro 准确率仅 27.27%,揭示模态 Agent 在视觉理解、工具调用等方面挑战大。

深度学习自然语言处理
新闻资讯7

谨慎用OpenClaw:上海科技大学发布其全面安全体检报告

上海科技大学联合上海人工智能实验室对爆火的智能体OpenClaw做安全审计,在34个测试场景中,整体安全通过率58.9%,暴露出方面问题,研究据此给出纵深防御策略。

AIGC开放社区
开源动态8

模态Deep Research,终于有了「可核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
产品应用8

Agent、图像、视频全是大版本升级:春晚还没开,豆包AI就火了

2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含大模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。

机器之心
产品应用8

Seedance 2.0,凭什么刷屏?

2026年2月7日,字节跳动旗下AI视频生成大模型Seedance 2.0开启内测后刷屏。它解决AI视频可用率低、成本高的痛点,引发资本市场关注,虽面临挑战,但也让AI视频成可用生产力工具。

芯师爷
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计。

量子位
算法论文8

治好模态近视和走神!上海大学去偏干预显著提升模型性能

模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区