多语种支持」共找到 4833 篇相关文章

8

Github斩获1.8K 星!!再见了按键精灵,Windows-MCP开源了!

今天介绍超酷开源项目Windows - MCP,它让AI与Windows系统互动,支持Win7到Win11。功能强大,不挑大模型,工具全、轻量开源、扩展性强。还给出安装步骤,不过使用时要谨慎。

开源先锋
算法论文7

智能体的致命三要素及六种安全设计模式

智能体发展带来诸安全问题,仅靠外部防护不合理。Simon Willison总结其致命三要素,指出间接提示词注入攻击难防。Invariant Labs等提出六种安全设计模式,可综合使用,LLM方法值得关注。

AI与安全
新闻资讯8

何恺明评审,谢赛宁获奖!牛津华人博士生拿下CVPR 2025最佳论文

CVPR 2025奖项揭晓,投稿量增13%,接收率22.1%。最佳论文来自牛津与Meta AI,提出新前馈网络。还公布年轻研究者等奖项,何恺明任最佳论文评审。

新智元
开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在问答数据集表现优,为智能化检索提供新思路。

量子位
算法论文8

RAG 2.0 深入解读

文章深入解读RAG 2.0,指出其虽在行业落地,但面临模态处理、检索质量等挑战。还介绍架构升级,阐述检索、重排序等关键技术,最后探讨统一模态大模型、安全等发展方向及挑战。

阿里云开发者
新闻资讯7

GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉

清华教授、智谱唐杰在𝕏征集GLM下个版本意见,浏览量达40w+。此前他有求必应,网友热情参与。这次评论区要视觉能力,因GLM-5.2是纯文本模型,而对手模态。

量子位
算法论文8

高潮从第几秒开始?GaMMA 让模态大模型真正「听懂」音乐时间线

现有模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在基准上表现优异,刷新 SOTA。

机器之心
开源动态7

专业抖音数据采集与交互解决方案

该项目提供专业抖音数据采集与交互解决方案,支持数据爬取、直播间监听、私信收发等功能。它将抖音复杂通信协议封装成 Python 函数,还介绍了各功能实现原理、运行环境及项目地址。

GitHubStore
产品应用8

阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合

阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持长指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。

AIGC开放社区
算法论文8

「听觉」引导「视觉」,OmniAgent开启全模态主动感知新范式

针对端到端全模态大模型痛点,浙江大学、西湖大学、蚂蚁集团联合提出 OmniAgent,它基于「音频引导」,用「思考 - 行动 - 观察 - 反思」闭环实现范式转变,在基准测试中超越开闭源模型。

机器之心