港科大」共找到 5110 篇相关文章

推荐文章7

为什么我觉得AGI并不会马上到来

作者Dwarkesh Patel认为AGI不会马上到来。当前语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。

宝玉AI
新闻资讯7

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

Datacurve推出新基准DeepSWE,号称「零污染」,用113道原创题挑战旧编程榜单。它使GPT和Claude名次逆转,揭示旧基准验证误差、存在作弊现象,虽有局限,但反映编程基准竞争转向抗污染和验证可信。

新智元
新闻资讯8

250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警

Anthropic最新研究揭示,仅250篇恶意网页就能让模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。

新智元
产品应用8

英伟达联手QCI搞事:量子应用能在真机前先模拟纠错

量子电路(QCI)公司联合NVIDIA,将CUDA - Q编程能力集成到Aqumen软件套件。QCI的双轨量子比特设计易纠错,有检测、控制流、处理错误三功能。二者结合能让开发者在真机前模拟纠错,加速量子计算商业化。

AIGC开放社区
新闻资讯7

毕业7年,身价破亿!清北AI天团血洗硅谷,奥特曼被逼分天价股份

清北中科等名校毕业生在硅谷成超级明星,谷歌因Meta挖人给员工涨薪,OpenAI为留人给部分员工加薪、送1/3股权。AI人才薪资差距,国内AI人才也多出身名校,需求和高薪职位增长快。

新智元
算法论文8

都说记忆是Agent标配,但MemSyco发现漏算了一件事

厦门学与吉林学的最新研究指出,随着模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。

PaperAgent
产品应用8

豆包「打电话」升级 Seeduplex:周围再吵,只认准你的声音

作者分享使用豆包语音通话功能体验,发现它换了新语音模型 Seeduplex。该模型是原生全双工语音模型,解决半双工问题,在复杂场景表现出色,还介绍其技术逻辑及对行业的影响。

特工宇宙
推荐文章8

AI 智能体实践评估:基准、框架与经验总结

文章为将 AI 智能体从原型落地到生产环境的团队提供实用评估框架。指出传统评估不适用于智能体,介绍评估工具,阐述五评估支柱,还给出基于 Claude 和 LangChain 的评估示例及实践经验。

InfoQ
算法论文8

「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!

上海交通学与蚂蚁集团联合团队发布多模态模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型单次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。

AI科技评论
产品应用8

不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?

文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。

机器之心