「内生可解释性」共找到 522 篇相关文章
Claude版Manus宕机,全网炸锅!顶级开发者曝光致命缺陷
Claude Cowork开年爆红,引发大量关注和讨论,两天内浏览量达五千万,甚至因太火爆致Claude用量太大而宕机。Django之父Simon Willison揭露其核心机制,也指出存在提示词攻击风险。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。
机器人“会用手”了!银河通用首破手掌任意朝向旋转难题,拧螺丝、砸钉子样样精通
银河通用推出的灵巧手神经动力学模型DexNDM,让灵巧手实现从能动到能用的飞跃。它首次突破手掌任意朝向旋转难题,实现跨物体、跨姿态稳定操作,助力机器人迈向精细操作,推动灵巧操作走向生产力基础设施。
奥特曼:OpenAI上市,势在必得
OpenAI完成架构重组,为IPO铺平道路。奥特曼公开AGI路线图,预计十年内迈入AGI时代。重组解除盈利上限,可自由增发股票和上市。微软支持转型,双方续约合作。OpenAI在技术、商业等多方面有新进展与规划。
Sora爆火之际,这家AI公司的DAU正以每月翻倍速度狂奔——Agnes
OpenAI的Sora爆火,而AI Agent产品Agnes正走不同路线。它三个月内全球注册用户破百万,DAU逼近10万,ARR达780万美元且近乎每月翻倍。其多模态社区预计10月上线,追求“Vibe Lifestyle”理念。
刚刚,这家0产品0模型就估值854亿的公司,终于发布了首款产品!
Thinking Machines Lab推出首款产品「Tinker」,这是专为语言模型微调而生的API,让开发者摆脱底层架构束缚,用简单Python代码专注创新。它功能强大,目前免费私测,已获普林斯顿、斯坦福等团队使用。
劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:大厂内部分散,AI研究很低效
26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在与主持人对话中,他分享经验,认为大厂内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。
年薪两百万研究AI精神病??Claude团队新部门火热招聘中
Claude团队启动“AI精神病学”小组,年薪两百万元招人。小组研究模型角色、动机等,来解决其诡异、失控行为。Anthropic可解释性部门有相关研究成果,网友对“AI精神病学”看法不一但前景值得期待。
世界首个「实时、无限」扩散视频生成模型,Karpathy投资站台
Decart发布世界首个「实时、无限」扩散视频模型MirageLSD,输入视频流能快速转化画面,前特斯拉AI总监Karpathy投资。它在时长和延迟上有突破,也有需改进之处。