「港科大(广州)」共找到 5125 篇相关文章
想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025
近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。
AI 赋能 eBay 支付风控:从用户行为到交易安全的全面智能化|AICon 北京
6月27 - 28日AICon全球人工智能开发与应用大会北京站将举办,eBay高级技术专家魏瑶将分享《AI赋能eBay支付风控》。eBay用AI提升风控能力,也面临挑战并提出方案,大会还有多专题论坛。
张鹏对谈李广密:Agent 的真问题与真机会,究竟藏在哪里?
本文是《今夜科技谈》直播沉淀,极客公园整理。拾象科技李广密、钟凯祺从多维度拆解 Agent 真问题与机会,探讨产品、技术路径、商业模式等,指出 Agent 发展方向与挑战。
CVPR2025 | 多模态LLM评测Tutorial
多模态大语言模型(MLLMs)研究热门,有效评估成关注焦点。CVPR2025将举办多模态LLM评测Tutorial,梳理评估基准,探讨评估方法,聚焦‘幻觉现象’,团队经验丰富,覆盖多板块内容。
3B小模型吊打72B巨头!轻量级文档解析OCR,性能超Gemini,高效且精准!
Yuliang - Liu团队在GitHub开源轻量级文档解析模型MonkeyOCR,以SRR三元组范式实现高效精准解析,3B参数模型在英文文档解析上超Gemini 2.5 Pro和Qwen2.5 - VL - 72B,还介绍了安装部署、适用场景等。
AI加持的开源知识库新秀:PandaWiki,如何用它打造智能化文档系统?
PandaWiki 是长亭科技开发的 AI 大模型驱动的开源知识库搭建系统,能助力用户快速构建智能化文档系统。它有 AI 创作、问答、搜索等功能,安装简单,适用于多场景,优势明显。
从性能到实战,怎样才算是靠谱的 Agent 产品?
红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。
30 年 FAANG 大神被 C++ Bug “虐”4年,竟被Claude Opus 4一招解决!
上周 Anthropic 发布 Claude Opus 4,称其为“全球最强编程模型”。本周,有 30 多年 C++ 开发经验的 ShelZuuz 用它解决了困扰 4 年的“白鲸 Bug”,此前用 GPT - 4.1 等模型均无果。不过他认为它像“初级开发者”。
全靠Claude4!30年FAANG老工程师:AI帮我解决了4年老bug
5月22日Anthropic推出Claude 4系列大模型,Claude Opus 4是领先编码模型。Reddit上30多年经验的前FAANG工程师称,它解决了困扰自己4年的C++ Bug,引发热烈讨论。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。