「神经图形学」共找到 477 篇相关文章
大模型幻觉的源头找到了!清华团队锁定大模型宁愿说谎也要讨好人类的神经元
清华大学研究团队深度解剖大语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。
耗时15年、扫描1400个大脑!她发现了藏在人脑中的「生物版ChatGPT」
MIT神经科学家Ev Fedorenko扫描约1400人大脑,识别出“生物版ChatGPT”——语言网络,它负责将词语与意义映射、拼成句子,揭示了语言与思维分离,研究发表在《Nature Reviews Neuroscience》。
图像编辑新神器:英伟达用拍电影思维解决图像编辑与世界模拟一致性难题
AI图像编辑物理一致性难题待解,现有方法易产生违反物理定律的漂移编辑。英伟达和多伦多大学提出ChronoEdit框架,将图像编辑视为拍微型电影,借助视频生成模型的时间连续性知识解决问题,在实验中表现卓越。
前两天刚被群嘲,ChatGPT转头就解决了一个数学难题
前些天,OpenAI研究员宣称GPT - 5‘发现’数学难题解法被指只是检索文献引群嘲。但加州大学洛杉矶分校教授用ChatGPT解决凸优化未决问题,还有教授用其发现命题反例,甚至要将其列为论文一作,AI正成研究伙伴。
告别黑箱解释!首个潜变量自动解释框架 | CIKM'25
深度生成模型内部运作如「黑箱」,潜变量意义难捉摸。埃默里大学团队提出LatentExplainer框架,经数据扰动、智能提示、不确定性评估三步,为潜变量生成易懂解释,提升模型解释质量与可靠性。
AI画手总是六根手指?阿大/美团/上交首次系统量化扩散模型计数幻觉
阿德莱德大学、美团和上海交通大学团队首次系统研究扩散模型“计数幻觉”问题。构建CountHalluSet数据集套件量化该问题,揭示其与采样条件的关系,还提出JDM模型缓解计数幻觉。
重磅!Claude Sonnet 4.5发布,可连续编程30小时,Claude Code同款构建工具也开放了
Anthropic发布Claude Sonnet 4.5,官方称是全球最强代码、复杂智能体构建及擅用计算机的模型。伴随产品全家桶升级,还开放Claude Code构建工具,发布Imagine with Claude。该模型能力强且更安全。
腾讯开源框架 Kuikly 再升级!率先适配 “液态玻璃”,原生体验更极致
腾讯开源框架Kuikly再升级,在苹果发布iOS 26系统背景下,新增“液态玻璃”适配。文章分析了“液态玻璃”给跨端框架带来的挑战,对比不同架构路线适配情况,还介绍了Kuikly的适配经验。
忘掉大模型,微软实证:小模型才是Agentic AI的未来!
过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。
突破单token预测局限!南洋理工首次将多token预测引入微调,编程任务准确率提升11.67%
当前主流大语言模型依赖下一token预测训练,难理解跨多token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将多token预测引入微调,能让模型理解完整概念,多领域实验显示其可显著提升模型性能。