「端到端对话模型」共找到 8395 篇相关文章
1100多个模型殊途同归,指向一个「通用子空间」,柏拉图又赢一回?
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间,表明架构比数据影响大。此发现能解释诸多现象,还有多种应用可能,但也有局限性。
4天100万下载,这个移动端Agent直接给谷歌偷家了。
蚂蚁的全模态助手灵光爆火,上线4天下载量达100万,三天冲上App Store总榜第六。它提前实现了谷歌AI Studio移动版的核心能力,以简洁报告输出和多智能体协作架构获市场认可,有望让创造力平权。
大模型上天、马斯克发射GPU?中国团队直接建「太空超算」
2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。
教全世界与AI对话的男人,正式加入DeepMind!提示工程封神
全球最牛提示工程师Riley Goodside入职谷歌DeepMind,他曾凭和ChatGPT聊天年入百万。他认为ChatGPT发布是提示工程里程碑,提示工程可分上下文工程和提示词编程。
强化学习之父:大语言模型走错了路,不符合「苦涩教训」精神
2024 年图灵奖得主、强化学习创始人之一 Richard Sutton 在播客中批评 LLM 发展方向,认为其无真正智能,违背「苦涩教训」原则,缺乏持续学习能力,仅模仿人类,未理解世界。此观点引发 AI 社区激烈讨论。
拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此
阿里推出总参数达1万亿的Qwen3 - Max - Preview (Instruct),比前一代Qwen3(235B)强四倍,发布即上线。官方测评显示它打败Claude Opus 4等对手,实测其编程能力出色,后续正式版值得期待。
告别“炼丹玄学”:上海AI实验室推出首个大模型数据竞技场OpenDataArena
上海人工智能实验室OpenDataLab团队推出开放数据竞技场OpenDataArena,致力于将数据质量评估从“玄学”变为“科学”。它有数据评测榜单和完整可复现的数据价值验证体系,为多类需求提供解决方案,还开源了核心工具。
对话张笑宇:一个科技史学者选择成为“AI降临派”|甲子光年
科技史学者张笑宇成“AI降临派”。他以“人类当量”和成本说明人类与AI的能力代差,提出全新治理架构,还谈AI应用困境、情感陪伴风险等,认为人类要与AI商定未来。
凌晨战神Qwen又搞事情!新模型让图像编辑“哪里不对改哪里”
Qwen团队发布Qwen-Image-Edit,作为Qwen-Image20B图像编辑版,能精准修改文字,还可新增、消除、重绘、修改元素,支持IP编辑、视角切换等玩法,在多方面表现出色。
桌面端已经过时了,这个 AI 直接在手机开了 Agent 商店
文章介绍 Macaron 应用,它有马卡龙形象的 AI 陪伴聊天功能,能记住用户习惯喜好。还可让 AI 生成手机 APP,有分享生态。其灵感库似应用商店,有经济系统,应用创建简单,完成度高,实现 AI 从工具到伙伴的进化。