「机制可解释性」共找到 4763 篇相关文章
专访 Aivilization 创始人:数十万人赛博捏崽的背后故事
本文是对 Aivilization 创始人的专访。该项目是“AI 原生”社会实验游戏,玩家可养成智能体。团队本想做公益游戏,没想到爆火。文中还介绍玩法、与其他项目差异、玩家画像,也提及成本、意外现象等。
SimpleTIR:让大模型“边写代码边思考”不再崩溃
SimpleTIR可解决多轮工具调用中训练崩溃问题。作者指出崩溃原因是分布偏移、低概率token链式雪崩和梯度爆炸。它采用void turn过滤,掐断崩溃链路,训练稳定,还催生多样推理行为,且工程友好已开源。
18岁女孩做养老机器人,上线2天卖爆了
18岁女孩Audrey Lo和团队推出养老机器人Sam,上线两天订单多到网站崩溃。它能24小时监测老人安全、提供陪伴,还可辅助护理人员。Audrey Lo此前还有两次创业经历,这款产品戳中市场痛点。
d-Matrix用3D堆叠技术终结"内存墙",AI推理迎来光速时代
2025年9月Hot Chips上,d - Matrix展示3D堆叠数字内存计算技术,直击AI“内存墙”难题。其产品Corsair带宽强大,新Pavehawk架构更有性能跃升,为AI推理开辟新赛道,虽面临挑战但前景可期。
OpenAI谈:大模型为什么会有幻觉?如何避免?
OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。
00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代
00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。
用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯
港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。
Hugging Face 推出九大 AI 课程,免费、全面【收藏】
Hugging Face悄悄上线一批免费AI课程,还带认证证书。课程从大语言模型到扩散模型,从计算机视觉到游戏AI,覆盖面广。完成课程可拿证书,还能在平台分享成果,是学习AI的好机会。
为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」
本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。
从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践
当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。