「内容质量」共找到 1431 篇相关文章
压缩之外,Visual Tokenizer 也要理解世界?
MiniMax和华中科技大学发布视觉tokenizer新研究VTP,引发业界热议。该研究揭示传统仅以重建为目标的视觉tokenizer缺乏高层语义表示,提出在预训练中引入语义理解,还发现Scaling Law现象,虽有争议但为研究提供新视角。
字节开源多模态复杂文档解析模型!Dolphin:页面与元素并行解析,精准解析复杂文档!
多模态AI与文档解析兴起,传统OCR解析复杂文档常出错。字节跳动开源多模态模型Dolphin,通过两阶段机制精准解析,有多种功能,安装使用友好,适用于多场景,降低了复杂文档解析门槛。
斩获3K+ star,再见传统开发!这款开源AI后台开发框架让效率提升300%
ruoyi - ai是基于ruoyi - plus开发的开源AI平台,集成前沿模型,有聊天、绘画等全栈AI能力,具多模态交互和企业级部署支持,核心功能丰富,技术架构优,有实战成效,与同类有差异。
优步通过实时信号与 Listwise 排序改进餐厅推荐
优步在Uber Eats推荐系统引入实时用户信号与Listwise排序法,用实时信号处理层替换早期特征流水线,还引入Listwise排序优化候选餐厅排序,降低特征漂移,保障系统性能。
结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26
宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。
白杨SEO:个人/企业如何在AI搜索时代占有一席之地?
白杨SEO作为AI搜索优化GEO研究者,分享个人或企业在AI搜索时代占位方法,指出占位仍有用,只是从关键词匹配变为用户意图匹配,还给出三点占位建议。
AI的七窍打通了!谷歌发布Gemini Embedding 2原生多模态嵌入模型
谷歌发布Gemini Embedding 2新型基础架构,将文字、图像等数据整合到统一维度,终结旧工作流。该系统赋予机器五维感知,建立跨媒介沟通语言,提升运行效率,在多场景有应用潜力。
算力都去哪儿了?这个 Seedance 2.0 生成的梗视频给出了答案
有人用Seedance 2.0将Anakin and Padmé梗做成AI视频讽刺AI行业。视频对话暗示算力用途与宣称不符,最后几秒AI将帕德梅形象处理成擦边画风,揭示算力真实去向。
AI“租人”平台一夜爆火:时薪3500、2.4万用户抢着“卖身”,专家:警惕劣币驱逐良币
AI社交网络Moltbook引发恐慌后,RentAHuman.ai网站上线将AI雇佣人类变为商业系统。上线一天访问量破50万,超2.4万用户“挂牌待租”,引发热议与担忧,专家也给出相关判断。
谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?
当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。