实时视频定位」共找到 1538 篇相关文章

新闻资讯7

倒反天罡:「租个人」网站爆火,AI开始雇人「跑腿」了

「rentahuman.ai」网站定位为「AI 的肉身层」,AI 可通过 MCP 协议或 REST API 雇人完成线下任务。网站上线后人力增长快,但也引发付款、任务真实性、安全伦理等疑问。

机器之心
新闻资讯7

刚完成“卖身”重组,TikTok就瘫了!Oracle 背锅:暴风雪吹坏了数据中心

近日,TikTok 美国业务重组后出现大面积瘫痪,许多用户无法上传或观看视频。TikTok USDS 称是美国数据中心电力中断所致,Oracle 回应是冬季风暴让数据中心停电,TikTok 正推进恢复工作。

InfoQ
新闻资讯8

AIGC超新星专栏丨玩AI的小笼包:我离开互联网大厂,用AI重新定义“内容总监”

北京AIGC视听产业创新中心对话‘玩AI的小笼包’。她曾是大厂内容负责人,后投身AIGC创作。她分享了创作转型经历、‘超创’生态及工业化生产流程,也谈及技术挑战与行业发展方向。

郎园Station
算法论文8

多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
算法论文8

12毫秒暴露自动驾驶致命缺陷,北航新研究实现场景感知的动态物理对抗攻击|TPAMI2025

近日部分L3级自动驾驶车型获批上路,但自动驾驶感知系统存在缺陷。北航等机构提出DynamicPAE框架,实现场景感知的动态物理对抗攻击,解决多维度挑战,在多场景表现优异,被TPAMI2025录用。

量子位
产品应用7

Unsloth让大模型跑在手机上!

Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰机上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。

AI工程化
推荐文章7

记录下SGLang 开发,debug的几个技巧第二弹

作者BBuf继上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。

GiantPandaLLM
推荐文章7

对话鹿明CTO丁琰:数据会反向决定模型,甚至影响硬件形态 | GAIR 2025

本文是对鹿明CTO丁琰的访谈。丁琰博士最早将UMI落地实践,其数采方案「FastUMI」受青睐。他认为UMI是完整体系,数据会反向影响多方面。还对比多种数采方式,介绍FastUMI改进及Pro版优势。

AI科技评论
新闻资讯7

GAIR Live 预告|智能始于记忆,AgentMemory 的技术演化过程

在人工智能走向智能体阶段,‘记忆’成焦点。如今大模型‘记不住’上下文,‘从Human Memory到Agent Memory’跃迁是迈向具身智慧关键。GAIR Live将邀专家探讨记忆技术逻辑与路径。

AI科技评论
开源动态8

NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!

英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现全模态理解,还支持多种功能。

带你学AI