「多模态智能检索」共找到 4318 篇相关文章
字节Seed团队发布Seed1.5-VL,用仅20B活跃参数在60个主流测试中狂揽38项第一!
字节Seed团队发布Seed1.5-VL,仅200亿活跃参数就在60个主流测试中获38项第一。介绍其架构、预训练、后训练等情况,评估表现出色,虽处理复杂场景有局限,但仍在多模态任务取得显著进展。
刚刚,GPT-6代号再泄露!或将周四见
据传GPT - 6本周将发布,OpenAI「义父」爆料Codex接入最强Astra模型,其内部代号「mewfour」泄露。Astra内部版已解决多个数学难题,成本仅约2000美元,还或达网络安全最高能力阈值,可能开启多智能体原生时代。
机器狗翻了个身,国产GPU往前走了坚实一步|甲子光年
5月18日摩尔线程发布会上,机器狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以全功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。
不吹不黑,在Agent任务上,kimi 2.6确实让我忘了Claude。
Kimi K2.6发布并开源,代码和Agent能力提升。作者测试发现,它在部署Claude Code源码、网站生成、多智能体任务等方面表现出色,审美提升,思维活跃,还能复刻文档风格,开源释放了前沿编程能力。
当心!腾讯、字节等揭示,OpenClaw有无法修复的安全死结
加州大学等机构团队发布对OpenClaw安全的深度分析报告。它是广泛部署的个人伴侣智能体,运行依赖进化理念,但记忆文件成攻击入口。研究在真实网络测评,发现其安全漏洞大,且难以找到进化与安全的完美平衡。
告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆
中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。
杭州再出黑马,中国千亿市场被炸穿!AI「杀死」会计,达摩院大佬出手了
杭州精算家的「深蓝财鲸」炸穿国内千亿财税市场,实现90%降本。它具多智能体协作框架与动态策略进化引擎,冲击传统代账公司和中小企业财务岗,其团队来自达摩院,对标美国巨头Intuit。
谷歌Agent杀入电商赛道:AI直接帮忙比价下单,马斯克:有意思
谷歌CEO官宣发布谷歌版Agentic电商解决方案,从UCP协议到Gemini CX,AI Agent贯穿购物全流程,可自动比价下单、领券等。国内阿里、京东、抖音等电商平台也在积极布局智能体电商。
快手可灵也吃上了香蕉,一通离谱prompt测试,好好玩要爆了
ChatGPT发布三周年,快手可灵AI视频「O1模型」登场,号称“全球首个统一多模态视频模型”。实测显示它能一站式搞定视频修改、镜头延展等操作,还推出了图片O1模型,在图片生成方面表现出色。
TruthfulRAG,用知识图谱硬刚RAG知识冲突
RAG系统存在知识冲突问题,现有解决方法治标不治本。TruthfulRAG将非结构化文本转化为结构化事实,通过图构建、图检索、冲突解决三大模块解决冲突,实验显示其表现优异,结构化表示还提升了LLM置信度。