多模态文本智能」共找到 4477 篇相关文章

开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。

量子位
新闻资讯7

The Batch: 846 | 好模型做出坏选择

研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。

DeeplearningAI
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

时隔5个月,xAI发布通用模型Grok 4,后续还将推三款模型。Grok 4上线,有三个订阅版本。马斯克称其智能超博士生,多项基准测试领先,编码或超Cursor。其性能强大源于训练投入和计算扩展。

AI前线
开源动态7

开源版 Cowork 项目在 X 爆火,创始人:感谢 Cowork,让我们三年的探索被看到

Anthropic的智能体工具Cowork在X上爆火,CAMEL AI的开源项目Eigent作为平替也跟着火了一把。文章复盘了CAMEL AI从2023年发布CAMEL框架到Eigent项目的三年探索经历,介绍了Eigent的产品设计、技术架构、应用场景及发展情况。

Founder Park
新闻资讯7

cursor翻车了,Anthropic:来,我教你怎么做long running Agent。

近期,Cursor宣称用大量智能体实现长程任务引发关注,但被指是营销惨案,代码存在诸多问题。Anthropic则分享务实的long - running思路,是记忆接力模式,代码可维护。未来模型能力提升或让代码成黑箱。

探索AGI
新闻资讯8

独家解读|2025年AI五大趋势与底层数据革命

2025 年 AI 发展重心转移,高质量数据成新基石。本文解读五大技术趋势,如多语种 TTS 与全双工交互、多模态大模型等,还介绍了各趋势的数据需求及数据堂提供的相应数据服务方案。

机器之心
开源动态8

DeepSeek倒逼vLLM升级!芯片内卷、MoE横扫千模,vLLM核心维护者独家回应:如何凭PyTorch坐稳推理“铁王座”

本文介绍了vLLM的发展,自开源后成科技公司首选推理引擎。因DeepSeek发布,团队转向其模型特性优化;还参与各芯片支持工作。vLLM靠PyTorch支持多硬件,同时拓展到多模态推理,面临竞争仍保持优势。

InfoQ
算法论文8

BookRAG:专治各种「层次化复杂」文档

BookRAG专为处理层次化复杂文档而生。传统RAG有两大盲区,而BookRAG在多模态长文档基准上刷新SOTA。它采用BookIndex×Agent - based Retrieval技术方案,效率高、可扩展性强,兼顾高精度、高召回、低成本。

PaperAgent
新闻资讯7

英伟达2026奖学金,8位华人博士统治榜单!人均6万美金

2026 - 2027年度英伟达研究生奖学金名单揭晓,10位获奖者中华人学者占8席。该奖学金提供最高6万美金科研经费与暑期实习机会。研究方向涵盖神经渲染、AI安全等,体现英伟达关注具身智能和AI安全。

新智元
新闻资讯7

小扎“亿元俱乐部”车门焊死!被曝冻结招聘,禁止内部人员流动

Meta超级智能实验室被曝冻结招聘,禁止员工跨团队调动。此前Meta大举招人,现因新老员工矛盾、AI部门重组及市场对“AI泡沫”担忧等因素调整战略,虽AI投资有收益,但仍需评估。

量子位