前端多模态智能」共找到 4270 篇相关文章

产品应用8

AnyGen款新AI工具,专门解决打工人最头疼的3件事,Doc,PPT,Excel

字节跳动2025年12月在海外推出一站式AI协作工作台AnyGen,强调人机协作打磨。产品有文档、通用智能体、幻灯片、数据分析四个核心模块,能解决会议纪要整理、PPT制作等痛点,还与主流工具做了横评。

AI Reading Hub
开源动态8

一个框架,重塑具身研发流程:Dexbotic走向具身PyTorch

开源具身智能原生框架 Dexbotic 宣布支持 RLinf 作分布式强化学习后端,打通 VLA 模型研发中「SFT 与 RL 割裂」问题。其 2.0 版实现模块化解耦与多源混训,构建开发闭环,孵化出 DM0 大模型。

机器之心
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
算法论文8

告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍

视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。

机器之心
新闻资讯8

硅谷前沿访谈:CUDA之父复盘英伟达20年护城河,揭开万亿算力帝国的底牌

奇点智能研究院院长李建忠采访了“CUDA 之父”Ian Buck,探讨 CUDA 20 年演进、英伟达技术产品及生态。Ian Buck 介绍了 AI 基础设施新阶段,阐述 CUDA 成功原因,还谈及英伟达软硬件协同、应对竞争等问题。

AI科技大本营
推荐文章7

AI 一键生成网站之后,最残酷的差距出现了:代码不再值钱,审美决定生死

知名前端开发者 Wes Bos 认为,2026 年将是“设计复兴之年”。当 AI 能让任何人快速生成网站,真正的差异化将来自审美、取舍和打造独特体验的能力。如 Lando Norris 官网,靠精心设计吸引关注。

InfoQ
产品应用7

GEAClaw 来了:企业级“OpenClaw”,一只有商业头脑的龙虾

文章指出当前大语言模型解决问题多为收敛式,与商业问题需先发散再收敛的方式相悖。特赞发布企业级智能体系统GEA,其架构四层分工明确,能在市场洞察、社媒增长等场景发挥作用。

AI寒武纪
开源动态8

最强开源搜索再升级,研究、预测能力实测超惊艳!

MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。

开源先锋
开源动态8

AI太难学?清华开源一批「学习虾」,免费的AI私教团来了

清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC,它能将技术文档转化为零门槛学习课堂,还可解锁多种学习解法。其前身MAIC是重要学习平台,OpenMAIC功能强大,应用场景广泛。

CourseAI
新闻资讯8

种子轮10.3亿美元!谢赛宁加入,LeCun的世界模型公司太吸金了

图灵奖得主 Yann LeCun 创办的先进机器智能实验室(AMI)官宣起航,完成 10.3 亿美元种子轮融资,估值 35 亿美元,谢赛宁加盟。AMI 目标是做理解现实世界的 AI,想走世界模型路线。

机器之心