「应用AI技术」共找到 11567 篇相关文章
冲击自回归,扩散模型正在改写下一代通用模型范式
Google I/O 2025 开发者大会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散式 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人大推出 LLaDA,后发展出多模态模型,国内团队跻身前列。
世界模型的DeepSeek时刻!魔芯Flash World Model降本70%,跑出50FPS实时交互
魔芯科技发布全球首个超高帧率交互式世界模型 MoWorld,无需高端 GPU,实现影视级画质、50 FPS 实时交互,降本 70%。其技术架构先进,产业化路径清晰,获过亿美元融资。
The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试
阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。
他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力
2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。
王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1
美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。
欧洲科学与艺术院长 Klaus Mainzer:通用人工智能的终极通关秘籍,藏在思想史里 GAIR Live | 018
雷峰网专访欧洲科学与艺术院院长 Klaus Mainzer,他指出通用人工智能瓶颈在思想史,AGI 障碍是“具身性”哲学鸿沟。还提及量子计算等新兴技术前景,强调教育要整合,人类要担起 AI 时代责任。
6.6K标星!微软开源Agent自我优化框架,为智能体注入持续学习能力!
开发AI Agent常面临部署后难自动优化的问题。微软开源的Agent Lightning,加几行代码就能让Agent自动学习、持续优化,有事件追踪等核心能力,安装简单,应用场景丰富。
人形机器人企业穿越噪音
今夏,人形机器人产业曝光度达高点,质疑也随之而来。我国机器人企业未受干扰,仍积极探索。企业在实践中调整技术路线,深耕文化娱乐、工业和商业等不同落地应用场景,目标是让其走进家庭。
自我进化Agent综述:通往超级智能的进化之路
当前大型语言模型面对新知识、动态环境时存在固定参数瓶颈,自进化智能体研究应运而生。本论文作为该领域首部系统性综述,提出革命性框架,解析自进化智能体技术脉络与未来挑战。