互联网视频数据」共找到 3436 篇相关文章

新闻资讯8

OpenAI董事长Bret Taylor:2010 年的 SaaS 应用,就是 2030 年的智能体公司

OpenAI董事长Bret Taylor在对话中称,当下处于“加10倍速的互联网泡沫”时代,AI为初创公司带来挑战巨头的机会。他直言多数B2B公司“以客户为中心”是胡扯,还为AI创业者划红线,如应用公司预训练模型是烧钱。

AI科技大本营
产品应用8

AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图大题

火山引擎原动力大会发布豆包大模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图大题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。

新智元
新闻资讯8

AI一天写4.4万行代码却没合并,程序员:AI Coding 真正的瓶颈来了

本文分享腾讯AI原生研发的真实案例,指出AI Coding产能提升后,最大瓶颈已非模型能力,而是现有研发治理体系与人的注意力适配问题,同时预告2026奇点智能技术大会的行业实践分享。

AI科技大本营
产品应用7

当 Agent 走出 App:WorkBuddy 的朋友圈开始向外生长

9月2日深圳的WorkBuddy生态发布会,展示9款联名硬件,有30多个硬件品牌、30多个Buddy应用、100多个开放平台共创伙伴参与。WorkBuddy开放Agent能力,连接伙伴资源,解决数据和专业经验难题,开放硬件、应用与平台三层,但面临价值分配等问题。

InfoQ
开源动态7

AMD跑GLM 5.2,成本只要英伟达一半

推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。

量子位
产品应用7

大的来了:谷歌Gemini 3.0 Pro单次生成网页版操作系统,Win、Mac、Linux一网打尽

海外平台爆火的视频展示了用未发布的谷歌Gemini 3.0,仅靠几行提示词在2分钟内One Shot生成网页版操作系统。与Claude 4.5 Sonnet对比,Gemini 3.0优势明显,还展现出高超前端设计能力,但离真正构建操作系统仍有距离。

机器之心
开源动态8

社区供稿 | Hugging Face x 北京中关村学院等机构联合发布生成式基因组大模型Carbon:一场关于“生命语言”的范式革命

北京中关村学院等联合发布生成式基因组大模型Carbon并开源。Carbon家族有三个版本,旗舰模型Carbon - 3B在多任务匹敌70亿参数的Evo2 - 7B,运行速度快275倍。它在数据、分词、训练上有创新,还实现技术普惠,有多种应用场景。

Hugging Face
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
新闻资讯7

我在618主场,和3位顶尖技术博士聊了聊

本文讲述了作者在618与京东三位技术博士的交流。长林主导同品判别系统优化,采用模型蒸馏和数据筛选提升效率;星衍负责物流机械臂项目,强调打透场景;初雪专注语音识别,提升识别准确率和探索创新方向。京东还推出TGT计划吸引人才。

量子位
产品应用9

不踩点不微调!Figure最新模型盲测30个家庭:首次实现零样本全身泛化

人形机器人公司Figure发布最新端到端具身模型Helix 2.5,在30套未采集训练数据的陌生住宅开展全盲家务测试,验证Index预训练可让模型实现零样本全身泛化,整体成功率56%,远高于对照组的9%,证明人形机器人跨场景迁移的工程可行性。

AI前线