「高精度模型」共找到 8869 篇相关文章

产品应用7

视频进入可编辑时代:藏师傅教你视频版 Banana 可灵 O1

可灵发布大一统视频、图像生成和编辑工具 O1,支持在一个界面完成视频图片编辑生成。此次更新统一多模态视频大模型,支持多模态输入,有诸多新特性,还支持自由选择视频生成时长和风格转换等。

歸藏的AI工具箱
新闻资讯7

「一人公司」不强求,「Copilots 」更能填平 AI 产业落地的「Massive Delta」?

全球风险投资重心转向AI,2024 - 2025年AI融资额大增。虽资金流向头部通用公司,但Vertical AI交易数量有优势。其能吸引投资是因有商业回报机会,且新兴公司商业指标良好。不过通用模型落地有‘Massive Delta’挑战。

机器之心
算法论文8

工具增强的多模态LLM综述

多模态大语言模型(如GPT - 4V)虽有强大图文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景图,覆盖多维度,还指出挑战与对策。

深度学习自然语言处理
新闻资讯7

「2025 AI 实战手册」,年收入破亿的 AI 公司都在干什么?

硅谷 ICONIQ Capital 团队发布 2025 年度「The State of AI」报告,围绕 AI 产品落地,通过问卷收集 300 家 AI 公司高管回答,从开发、定价等五方面剖析 AI 产品端到端流程,还对比了 AI 原生和赋能型公司产品发展。

机器之心
算法论文8

T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」

在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。

机器之心
新闻资讯8

GAIR 2025 大会首日:AI重构教育、科学与产业的十三重碰撞

2025年12月12日,第八届GAIR全球人工智能与机器人大会在深圳开幕。众多顶级学者围绕AI对教育、产业等领域的影响发表演讲与讨论,如赵伟院士提出高校“加减替换”培养模式,贾佳亚教授认为大模型将走向“感知机器+终身学习”模式等。

AI科技评论
开源动态8

开源真强大,不敢相信,太真实,揭秘8.3k star 开源神器 VoiceCraft 如何封神!!!

VoiceCraft 是多团队合作推出的零样本语音编辑与 TTS 开源项目。它能几秒克隆语音,实现编辑功能,支持零样本文本转语音,在真实场景音频中性能超 XTTS - v2、VALL‑E 等模型,解决了内容创作和编辑痛点。

小华同学ai
新闻资讯7

传言称:Llama 4 团队80%成员集体辞职!

有爆料称Meta的Llama 4团队约80%成员集体辞职,引发AI圈关注。但Meta员工澄清该消息不准确,且无权威媒体证实。不过Meta和Llama 4项目确实面临高层动荡、模型延期等问题,还分析了可能的深层原因。

AGI Hunt
新闻资讯8

奥特曼最新深度访谈:AI至今没有iPhone时刻!

OpenAI首席执行官山姆·奥特曼在深度对谈中复盘大模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功学经验等观点,反驳末日论。

AI寒武纪
产品应用8

豆包的新身份曝光:在国际艺术展当起了“AI讲解员”

文章讲述作者在浦东美术馆「AI与艺术」豆包讲解体验日活动的经历,实测豆包作为AI讲解员的业务水平,如筛重点、实时讲解、补知识,还揭秘其靠豆包大模型1.8的多模态处理等能力任职。

量子位