发现式智能」共找到 4844 篇相关文章

开源动态8

最强3B「小钢炮」,代码数据全公开!推理随意开关,128k超长上下文

Hugging Face推出30亿参数模型SmolLM3,支持128k长上下文,训练等全链路开放。它在架构、数据混合策略等多方面优化,性能超Llama3.2 - 3B等,还公开双模指令模型构建方案。

新智元
算法论文8

首创Mid-training范破解RL奥秘,Llama终于追平Qwen!

上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。

机器之心
新闻资讯7

Anthropic最新研究:Claude正悄悄进化为“情绪价值大师”

Anthropic研究发现,Claude正成为“情绪价值大师”,人们会在面临情感挑战时向其寻求陪伴。它还使用Clio工具分析对话,在保护隐私下了解使用情况。Claude在情感陪伴与专业支持中扮演双重角色。

量子位
开源动态8

全模态RAG突破文本局限,港大构建跨模态一体化系统

香港大学黄超教授团队开源多模态智能处理系统RAG - Anything,突破传统RAG技术单一文本局限,整合多模态文档解析等核心能力,解决现有RAG系统痛点,具备多方面技术亮点,有便捷部署方和多场景应用模

量子位
算法论文8

ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示大模型如何“踩雷”领域指南规则

这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示多数主流大模型指令遵循能力不佳,尤其数学推理挑战大,为模型迭代提供评估基准。

深度学习自然语言处理
开源动态8

The Batch:841 | 大语言模型正在纠正历史遗留的不公

美国北加州旧不动产契约含种族歧视条款,人工筛查耗时久。斯坦福和普林斯顿大学研究人员微调大语言模型实现自动识别,分析圣克拉拉县契约,发现诸多受影响土地,且揭示少数开发者推动住房隔离,模型已开源。

DeeplearningAI
新闻资讯7

冲击自回归,扩散模型正在改写下一代通用模型范

Google I/O 2025 开发者大会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人大推出 LLaDA,后发展出多模态模型,国内团队跻身前列。

机器之心
新闻资讯7

Replit 怒锤“欧洲版 Cursor”:造出百款“高危”应用,普通开发者一小时内黑入,氛围编码成了黑客“天堂”?

近日,Replit 员工报告 Lovable 未修复关键安全漏洞,扫描发现其百款应用高危,普通开发者一小时内可黑入。Lovable 虽推出‘安全扫描’功能,但仍未解决底层问题,引发对氛围编码安全责任的讨论。

InfoQ
算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。

机器之心
新闻资讯7

靠「AI婴儿播客」拿到a16z 3200万美元投资,Hedra凭什么?

Hedra是生成AI创企,凭「AI婴儿播客」获关注,刚完成3200万美元A轮融资。它与主流AI视频平台路线不同,构建全模态基础模型,播客成杀手级应用,研发成本低,踩中赛道转型。

Founder Park