港科大」共找到 5073 篇相关文章

算法论文8

ACL 2025 | 模型乱试错、盲调用?KnowSelf让智能体有「知识边界感知」能力

ACL 2025 论文《Agentic Knowledgeable Self-awareness》聚焦提升智能体「知识边界感知」能力。KnowSelf 方法让智能体自主调节知识运用,实验显示其性能优,还探索了智能体自我认知多方面影响。

机器之心
新闻资讯7

微软老员工48岁生日被裁,妻子发帖怒斥算法裁人!全球血洗6000人

微软全球裁员6000人,25年老员工生日当天被算法选中裁掉,他曾修复百万美元漏洞;TypeScript核心成员、AI总监也在裁员名单。微软称与绩效无关,是为简化管理层级,也可能因职位被AI取代。

新智元
产品应用7

变天了!WindSurf推出workflow功能,低代码模型应用开发平台将面对“降维”打击

Windsurf在1.8.2版本推出workflow功能,其采用自然语言定义工作流并与开发IDE深度集成,是更高级形态。该功能特性丰富、应用场景多,对Dify等应用编排工具或造成‘降维打击’。

AI工程化
新闻资讯7

AI证伪百年数学猜想被打假!Lean证明惊现漏洞,哥教授破防了

OpenAI新推理模型取得十项数学进展,如证明非Sofic群存在性等。哥伦比亚学副教授Henry Yuen对其量子并行重复定理证明既兴奋又失望,因证明有AI味且难理解。此外,Lean证伪科拉兹猜想被指利用内核漏洞,专家提醒Lean验证有局限。

新智元
开源动态8

刚刚!Meta把模型塞进脑机接口,隔空读脑直逼开颅植入水平,代码全开源

Meta推出Brain2Qwerty v2,号称性能最强端到端方案,能基于非侵入式脑部记录实现实时句子级解码,准确率逼近开颅手术水平。还开源代码,公开数据集,旨在帮脑损伤患者交流。

AI寒武纪
算法论文8

蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三幻觉,现已接入MTEB

蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。

AINLPer
新闻资讯7

刚被马斯克收购,Cursor掏出新模型:10万卡加持,和Opus、GPT一样

本周二,刚被SpaceX收购的Cursor在首届旗舰会宣布新的1.5万亿+参数模型,在超10万块GPU预训练。Cursor CEO称其规模与Opus、GPT相当,还谈了对其他AI实验室看法,新模型将几周内发布。

机器之心
新闻资讯7

Anthropic智能体会:Agent也会精神分裂,我们发现了多Agent协作的本质解法。

Anthropic开发者会聚焦Agent,分享多智能体实战经验。Omni的Blobby出现‘精神分裂’问题,根源是内外层Agent能力认知断裂,修复方案是将工具上提。Anthropic团队则通过协商签订协议解决角色定义不一致问题。

探索AGI
开源动态8

不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑模型彻底变天

谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。

AI寒武纪
开源动态7

AI 终于能"玩手机"了:Mobile MCP 让模型直接操控你的 iOS 和 Android

Mobile MCP 是开源 MCP Server,让支持 MCP 协议的 AI 客户端操控 iOS 和 Android 设备,通过自然语言指令完成操作,解锁自动化测试等场景,但成功率有待提升,目前更适合探索性测试等。

AI Reading Hub