港科大(广州)」共找到 5072 篇相关文章

算法论文8

没想到,又一个Code Agents瓶颈,被美团&上交彻底撕开了~

AI写代码能力提升,但打分方法僵化且成本高。上交与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。

PaperAgent
开源动态7

从社区数据出发,再看模型开源开发生态全景与趋势

蚂蚁开源先后在527蚂蚁技术日和外滩会发布模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。

InfoQ
新闻资讯7

爱思唯尔把Meta告了:拿Sci-Hub盗版论文训练模型

学术出版巨头爱思唯尔等多方原告起诉Meta,指控其未经授权获取、复制受版权保护的学术论文训练Llama模型,数据源于Common Crawl和盗版平台。Meta以‘合理使用’抗辩,AI版权合法性尚无明确判例。

量子位
新闻资讯7

蒙娜丽莎让模型们几乎全军覆没!网友:懂了,AI不会眯眼睛

日本艺术家北冈秋吉创作的蒙娜丽莎图难倒一众模型,ChatGPT、Gemini等表现不佳,国产玩家如豆包等也有判断失误。不过o3 - Pro一次性答对,GPT - 4o尝试三次猜对。

量子位
产品应用7

终于敢把真实地址、银行卡、种子词直接扔给模型了

作者将真实个人信息扔给多个模型测试,结果模型收到的是脱敏后的占位符,OneAIFW 能自动完成敏感信息的占位和还原,本地完成操作,不留日志不上云,还介绍了使用方法和项目地址。

GitHubStore
算法论文8

75页哈工多模态推理模型最新综述:感知、推理、思考与规划

哈工提出75页多模态推理模型综述,围绕四阶段发展路线图展开,即感知驱动的模块化推理、以语言为中心的短推理、以语言为中心的长推理、迈向原生多模态推理模型,还给出挑战性基准测试和实验案例见解。

PaperAgent
新闻资讯8

AI性格越好越爱瞎编!Nature揭开模型致命的温柔

牛津学团队实验发现,给模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。

AIGC开放社区
算法论文7

关于多模态模型Token压缩技术进展,看这一篇就够了

多模态模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。

机器之心
算法论文8

ICCV 2025 | 港科、牛津学发布AlignGuard,文图生成模型可规模化安全对齐框架

随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。

机器之心
算法论文8

首个GUI多模态模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心