「智能体强化学习」共找到 4580 篇相关文章
困住医疗AI的死循环,终于有国产玩家跑通了
文章指出医疗AI行业因数据、模型、场景闭环断裂陷入困境,整体渗透率低。讯飞医疗的星火医疗大模型V3.5评测和临床落地表现出色,其构建自强化循环体系,跑通死循环,或使行业马太效应渐显。
从数学思维到AI睡眠,于大川在千亿赛道的第二次“白魔法”创业|甲子光年
于大川曾创办豌豆思维,“双减”后他“半退休”。如今他重启创业,创立豌豆智能,想用AI改善人类睡眠。该公司已获君联资本天使轮融资,于大川分享了创业思路、产品模式、团队组建等内容。
独家 | 华为19级天才少年赵立晨离职创业,瞄准具身 Agentic OS
AI科技评论独家获悉,前华为天才少年、19级技术专家赵立晨2026年3月离职,加入杭州拉格朗日具身技术有限公司。该公司聚焦具身智能架构研发与硬件规模化落地,赵立晨想做的Agentic OS是具身产业化的基础设施。
终于有了一个用龙虾而不是 Claude Code 的理由
作者作为有十年多代码经验的人,原本习惯用Claude Code等白盒工具。但在文档处理、多人协作等场景中,飞书OpenClaw优势明显,可一键部署多智能体,与飞书生态打通,还能自动修复异常。
让AI打游戏!能玩1000多款游戏,英伟达用4万小时视频训练出通用基础模型NitroGen
NVIDIA发布NitroGen模型,利用40000小时带按键显示的游戏视频,构建视觉-动作数据集,训练出能玩超1000款游戏的通用基础模型,在跨游戏泛化和微调任务中表现卓越,为具身智能发展提供新思路。
社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型
Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。
谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!
当地时间 6 月 23 日,Linux 基金会宣布与多公司成立 A2A 项目,由谷歌捐赠协议规范等。A2A 支持智能体通信协作,谷歌称其将在中立治理下开发普及。此外还对比了 A2A 与 MCP、ACP 等协议,探讨实际应用问题。
清华初创&UIUC学者用7B模型在预测市场上自我蒸馏,跑赢GPT-5.6和Opus 5
UIUC学者联合清华初创团队Astraculum,围绕LLM部署阶段持续学习问题展开研究,提出Social World Model框架,基于预测市场数据测试,经自蒸馏的7B模型击败了GPT-5.6等多款前沿大模型,还搭建了专用MLOps引擎TrajOps。
国内首张防爆资质、全球首个加油大脑方案,他们凭什么拿下两个「第一」
今年是具身智能商业化落地关键年,深圳若愚科技携自研「若愚九天机器人大脑」及特种防爆机器人「若愚揽月 01」亮相。其拿下国内首张防爆资质,推出全球首个加油大脑方案,在多场景验证能力,技术有多项创新。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。