第一视角视频问答」共找到 1415 篇相关文章

新闻资讯7

全球开源大模型,前十五名全是中国的

近日,随着新一代大语言模型更新,开源大模型成热门话题。Design Arena排行榜上,若设定为“开源”,前15名均为国产开源大模型,排名第一的是DeepSeek - R1 - 0528 ,智谱、阿里等厂商多款模型上榜。

机器之心
开源动态7

Ultralytics & lightly-train:简化计算机视觉模型训练,无需标签

在计算机视觉领域,获取带标签数据成本高、耗时长。开源项目 lightly-train 用未标记图像和视频自监督预训练,减少标注成本与时间,可集成到现有训练管道,支持多种模型架构和应用场景。

机器学习AI算法工程
产品应用7

“导演梦”不再遥远:Captain Cinema 让你用短片制作出电影

约翰·霍普金斯大学与字节Seed团队推出自动生成短片的Captain Cinema系统。它以剧情文字为输入,先规划关键帧,再补全画面动态合成短片。采用特殊训练法和模型,虽有局限,但为电影自动生成迈关键一步。

带你学AI
7

OpenAI拿下IMO金牌,职业数学家崩溃:我终于明白李世石为何会落泪

AI在IMO获金牌,数学家Dave White自我认同崩塌,认为这是一种‘死亡’,探讨AGI带来的身份危机。加密教授Adam Cochran则从哲学视角回应,称人生身份重建与崩塌不断循环,真正的‘自我’超越单一标签。

新智元
开源动态8

无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab

多图像、长视频让大型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性能的前提下实现推理加速,且已在GitHub开源。

量子位
新闻资讯8

从高考到实战,豆包大模型交卷了

火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。

机器之心
新闻资讯8

Veo 3全网实测惊艳所有人!DeepMind CTO:规模是AGI全部吗?

谷歌推出视频生成模型Veo 3,一句提示词就能打造电影质感短片,还能音画同步,引发网友惊叹。DeepMind CTO在访谈中表示,规模非AGI唯一要素,还提及Deep Think模式及Veo 3进展等。

新智元
新闻资讯7

AMD:“拿捏”了英特尔,还要给英伟达“上强度”?

2025年第一季度财报显示,AMD营收74.4亿美元、净利润7.1亿美元,同比双升。客户端业务超预期,桌面级CPU份额反超英特尔;数据中心业务增长,GPU待新品发力。不过,MI308出口受限或影响业绩。

芯师爷
新闻资讯7

Gemini 3.8,明日登场!

最新爆料,Gemini 3.8 Flash明日登场,谷歌已放弃Gemini 3.5 Pro。其编程实力强悍,之前还为Gemini植入智能体视频理解功能,降本提效,可应对多种高难度场景。近期多家AI发布计划撞车,混战升级。

新智元
新闻资讯7

“烂出”1.35亿票房?AI二创《牛来》也疯狂,网友都惊呆了

2026年夏天,影视黑马《牛来》在AI二创助力下火出圈,截至8月18日票房破2100万,猫眼预测达1.35亿。网友用AI将其做成解说视频、游戏等,虽AI版精致,但有人认为缺真诚感。

鲸选AI