「自动给药」共找到 1233 篇相关文章
给AI打个分,结果搞出17亿估值独角兽???
大模型竞技场LMArena官宣拿下1.5亿美元A轮融资,估值升至17亿美元。它前身是Chatbot Arena,由LMSYS创建,核心成员多为顶尖高校学霸。LMArena评估规则有趣,成新模型必测榜单,计划用新资金运营平台、扩团队。
ROCK & ROLL!阿里给智能体造了个实战演练场 | 开源
阿里开源新项目ROCK,解决了智能体无法在真实环境中规模化训练的难题。它与阿里此前的RL训练框架ROLL配合,构成完整的智能体训练闭环,推开了Agentic AI规模化应用的大门。
吴恩达发布论文自动审阅器,ICLR上达到接近人类水平
目前学术会议论文评审无统一规范,投稿量膨胀致审稿周期冗长。吴恩达发布‘Agentic Reviewer’,在ICLR 2025数据测试中接近人类水平,现阶段在arXiv研究领域表现佳,但仍处实验阶段。
这家国内公司,在给具身智能技术栈做「通解」
具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示自研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。
Karpathy最新分享!给大模型做好“服务”将是巨大机会
近日,Karpathy在AI Startup School演讲,提出AI正从根本改变软件。他将软件分三个时代,认为LLM是全新操作系统,还指出其特长与局限,点明AI时代两大机遇:部分自主应用和构建Agent友好工具。
消费者别急,苹果给AI手机『画的饼』,大概是这样
6月10日苹果全球开发者大会举办,iOS 26发布引关注。苹果AI能力滞后,其筹划的AI手机有端侧AI分布、AI辅助能力先行、更酷炫大统一UI等特点,此次系统升级对其未来布局关键,苹果盈利和销量已下滑。
Agent大革命!Claude 4连续自动编程7小时,刷新世界记录
今天凌晨Anthropic召开开发者大会,发布Claude 4,含Opus 4和Sonnet 4。Opus 4编程智能体连续工作7小时破纪录,Sonnet 4在SWE - bench表现超前沿模型。还新增功能,Claude Code开放,API也有新特性,Sonnet 4免费但有限制。
答对了却没看图?EASE给多模态RLVR装上「视线校正器」
强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。
把事实核查嵌入诊疗流程:MedGuard给「诊疗安全」当守门人
蚂蚁AI安全实验室与厦门大学团队联合提出MedGuard,将医学事实核查嵌入诊疗流程。它是医疗安全基础设施,在诊疗意见等形成前验证事实,在评测和临床评价中表现突出,能准确判断风险边界,可嵌入医疗流程。
给机器人一个会预测未来的Critic,VLA强化学习直接起飞
OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。