「学习范式」共找到 2167 篇相关文章
从BERT到T5再到Qwen3:关于Embedding的八点总结
哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。
Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
Meta科学家毕树超在演讲中揭秘AI进化真突破,认为更好更快造数据是关键。他指出AI原生交互领域若有新突破,或催生万亿级公司,语音和视觉将成重要部分,还分享了AI进化时间线及面临的问题和未来图景。
一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!
AI编程助手看似热门,实则多数亏本运营。Cline选择开源,允许用户自由组合LLM编程,个人免费,企业服务收费。它一年成明星产品,获49.1k Star、近200万下载,其创始人分享了产品理念、发展等多方面思考。
比RAG高出8.9%,百度TURA:让搜索引擎“动”起来的下一代AI Agent架构
现有检索增强生成(RAG)系统只能读取已索引的静态网页,无法满足用户需实时数据的问题。百度TURA用工具调用把RAG升级为动态交互,其核心分检索、规划、执行三步,已在百度亿级流量场景跑通。
中国电信天翼AI发布首款AI眼镜,星辰大模型开启第一视角智能交互新时代
在2025世界人工智能大会上,中国电信天翼AI发布全球首款融合自研“星辰大模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰大模型,开创第一视角智能交互新范式。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。
智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了
智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。
OpenAI 新任应用CEO 首发长文:人工智能将成为人类历史上最大的赋能源泉。
前Instacart CEO Fidji Simo 8月18日加入OpenAI任应用CEO,她在长文表示AI可成人类最大赋能源泉,提出AI赋能的六个关键领域,强调技术价值在于让更多人受益。
大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年
大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。
Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子
Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。