「大语言模型集成」共找到 8268 篇相关文章

新闻资讯8

OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了

OpenAI发布GPT - 5.4,全面反击Gemini 3.1 Pro和Claude Opus 4.6。它是首个有「原生电脑使用」能力的通用模型,各维度无短板,成绩炸裂,定价也创新高。

新智元
新闻资讯7

AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。

InfoQ
开源动态8

Clawdbot:火爆硅谷,让开发者疯抢Mac mini的AI新物种

Clawdbot是诞生仅三周的开源项目,让AI走出聊天框成数字同事。它由退休程序员Peter Steinberger推出,能24小时运行在本地电脑,解决AI落地难题。许多开发者为此抢购Mac mini。

AIGC开放社区
产品应用7

Gemini 3来了,Software 3.0也快了

作者认为Gemini 3是目前最好的模型,编程时前端用Gemini 3,后端用Codex。无编程需求时,它也能助力信息处理。Google推出Generative UI,二者结合让我们接近Software 3.0。

newtype AI
算法论文8

NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临

传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。

机器之心
算法论文8

轻量高效,即插即用:Video-RAG为长视频理解带来新范式

现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。

机器之心
算法论文8

从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!

大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。

新智元
开源动态8

斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!

MinerU是上海人工智能实验室推出的开源数据提取工具,能将多模态文档解析为Markdown,支持精准提取图片、表格、公式,具有多语言支持、高性能等特点,应用场景广泛,还开源免费。

小华同学ai
新闻资讯7

马斯克版微信亮相:支持中文,加密聊天,还专门防截屏

马斯克版微信XChat将于4月17日上线,支持中文版。其核心主打加密聊天,功能有文字、图片等发送及视频通话,还内置Grok模型。不过网友质疑其难成功,因X已有聊天功能,且微信生态难撼动,市场竞争大。

量子位
开源动态8

8K Star!给所有 AI 编程工具加个智能调度中心,节省 20-40% Token!

AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token节省器,还有实用的三级降级机制,安装配置简单。

开源星探