上科大」共找到 6378 篇相关文章

算法论文8

模型幻觉的源头找到了!清华团队锁定模型宁愿说谎也要讨好人类的神经元

清华学研究团队深度解剖语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
新闻资讯7

DeepSeek、GPT、Qwen,所有模型架构图都有,Karpathy:宝藏画廊!

模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
算法论文8

启发学习:让模型认知从外化到内生

当下模型能力多靠人为框架,能力限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能幅提升模型任务性能。

机器之心
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?

模型价值主战场正向后训练转移。xAI发布的Grok 4通过后训练取得强性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五关键要素,阿里云提供一体化支撑。

InfoQ
产品应用8

稚晖君新招:机器人二次开发0门槛了!

在智元机器人首届合作伙伴,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月线beta版。

量子位
算法论文8

AI 会笑吗?BIGAI & 团队:多模态模型是否真的能 get 到视频笑点|ACL 2026

海交通学等团队构建v-HUB评测基准,分析多模态模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
开源动态8

AI操作网页:browser-use和AI模型互动解析

文章深入解析开源框架browser - use与AI模型互动方式。它能自动化在线任务,靠精巧prompt设计和不同类型Message输入实现高效交互,还总结出可用于其他模型交互场景的技巧。

阿里云开发者
产品应用8

融合风控知识的模型体系建设与应用实践

腾讯算法专家欧阳天雄在AICon会分享《模型驱动下的智能风控落地实践》,介绍腾讯天御融合海量风控知识构建金融风控模型,解决传统风控模型难题,还展示构建技术、工程实践及落地案例,为金融风控提供新思路。

InfoQ
新闻资讯8

Hinton海演讲:模型跟人类智能很像,警惕养虎为患

深度学习之父Hinton在海演讲《数字智能是否会取代生物智能》,指出人类可能是语言模型,也会有幻觉,但语言模型优于人类脑,知识传递高效。他呼吁建立国际社群,培养不夺权的好AI。

量子位
开源动态8

不只DeepSeek,阶跃等开源JetSpec:模型解码提速近10倍

近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示模型行业进入新阶段,推理效率成 Agent 落地基础变量。

机器之心