小而美」共找到 1822 篇相关文章

算法论文8

CVPR 2026|清华联合团推出3DThinker,首个用3D意象思考的工作

当前多模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在多基准上提升效果,且具备一定可解释性。

机器之心
开源动态8

团杀入视频生成模型赛道,LongCat-Video 136亿参数媲顶尖模型,效率提升10倍

团LongCat团队发布LongCat - Video基础视频生成模型,有136亿参数量,多任务表现出色。它核心亮点多,还建立了数据处理流水线,采用特殊架构和训练方法,提升了生成效率,性能媲顶尖模型。

AIGC开放社区
新闻资讯7

刚刚!扎写信:暗示要放弃开源路线,加入close AI行列,未来10年打造个人超级智能

扎发信称要打造并赋能个人超级智能,虽未明说放弃开源,但暗示谨慎选择开源内容,似要加入Close AI行列。Meta愿景是让个人超级智能普及,与业内部分观点不同。

AI寒武纪
新闻资讯7

马斯克收购OpenAI新计划实锤了:找扎筹千亿元,果然敌人的敌人就是朋友…

今年2月马斯克为收购OpenAI找扎克伯格筹资974亿元,想拉其入伙,曾有激烈冲突的二人放下前嫌,但Meta婉拒。扎忙于组建“亿元俱乐部”,OpenAI则因人才流失致HR负责人离职。

量子位
开源动态7

DeepSeek揭秘o1后,红书似乎破解了o3的技术路线,还开源了~

OpenAI闭源后,大家不知其先进模型技术路线,解密成重要任务。DeepSeek R1年初开源后引发关注,红书团队核心贡献的论文似破解o3谜题,还开源模型等,为训练调优提供可行路线。

探索AGI
新闻资讯7

社区供稿丨Hugging Face创始人 x 红书技术副总裁:关于开源、AI与技术人成长

今年1024程序员节,红书技术副总裁凯奇、语音模型技术负责人风龙与Hugging Face联合创始人Thomas Wolf深度对谈。围绕AI Coding、开源、AGI等核心观点展开,探讨开源闭源、AGI未来、AI人味及个人能力等话题。

Hugging Face
开源动态8

Github 3.6k star,爆火开源「红书 MCP」:一键登录、图文发布、搜索、评论全搞定

`xiaohongshu-mcp`把浏览器手工步骤封装成可编排工具,以Go编写,能在无头/有界面模式间切换。它解决红书运营多痛点,如登录不稳、发帖链路长等,覆盖登录、发帖等全链路,适配多客户端,值得收藏上手。

小华同学ai
推荐文章8

11篇顶会论文之外,图影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
产品应用8

团龙猫LongCat技术升级!新注意力机制解码速度快10倍,还能处理1M超长文本

团龙猫LongCat系列发布全新稀疏注意力机制LoZA,重点解决长文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性能不缩水,后续还计划支持动态稀疏比例。

量子位
产品应用8

团提出首个语音交互GUI智能体,端到端语音训练能力优于传统文本训练

团和浙大联合推出GUIRoboTron - Speech,这是首个能利用语音指令和屏幕截图端到端决策的自主GUI智能体。它解决了文本依赖问题,团队经多步骤研发,其性能评估表现佳,还给出招聘信息。

量子位