「Claude 4.x」共找到 2860 篇相关文章
业界首个高质量原生3D组件生成模型来了!来自腾讯混元团队
腾讯混元3D团队推出业界首个高质量原生3D组件生成模型Hunyuan3D - Part。现有3D生成算法有局限,该模型提出新范式,含P3 - SAM和X - Part,在多数据集评估中超越现有工作,还给出体验地址和论文地址。
1700亿美元估值!Anthropic融资50亿,AI独角兽争霸战进入新阶段
Anthropic拟融资30 - 50亿美元,估值达1700亿美元,或成全球估值最高未上市AI公司之一。它由前OpenAI成员创立,聚焦AI安全。核心产品Claude有独特优势,与GPT - 5各有千秋。其商业化侧重企业,虽增长快但亏损大,业内对估值看法不一。
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
老罗数字人爆火背后,百度做对了什么?
6月15日,罗永浩数字人在百度电商直播超6小时,吸引超1300万人次观看,带货破5500万元。它动作、语调等生动,能与弹幕互动。百度基于文心4.5T,从形、音、神让数字人“神形音容”一致,还实现行业首次多数字人同场及头部主播数字人整场带货。
大基金或将领投DeepSeek?算力拐点将至
5月6日报道国家大基金正洽谈领投DeepSeek首轮融资,估值约450亿美元。大基金此前未公开投资大模型公司,此次若落地是从“半导体硬件”向“AI应用端”延伸。2025年是中国AI芯片出货量关键年份,DeepSeek-V4发布,多家国产芯片品牌完成适配,但国产芯片仍面临性能、软件生态等挑战。
Sora 2 惊现 LLM 推理能力,视频生成模型也能搞推理?
Sora 2在科学推理基准测试中获55%成绩,虽不敌GPT - 5,但一个视频生成模型能做推理令人惊讶。Epoch AI实验发现其可能借LLM重写提示词答题,网友也证实背后或有GPT - 4o等处理。此外,Google研究显示视频模型经大量训练或有推理能力。
具身机器人能搞定超市盘点吗?全球七万门店正在给出答案
本文报道汉朔科技联合X-Era Lab(拓元智慧),依托汉朔全球近7万家门店的电子价签数字化底座,结合拓元自研原生世界动作模型VWA,探索具身智能在零售门店盘点、巡检、补货场景的商业化落地,验证具身智能能否从演示Demo转化为稳定运行的生产级系统。
马斯克暴走官宣:Grok 5就是AGI!五月连轰两代万亿怪兽,OpenAI慌了
马斯克宣称Grok 5就是AGI,5月将连发1T和1.5T两代万亿参数模型。Grok 4.3已上线,4.4、4.5将相继推出,Grok 5正以6万亿参数规模训练。不过,参数能否堆出AGI存争议。
诺奖得主实验室走出的中国团队,正用世界模型重构生命分子设计
过去 AI 分子设计多困于‘模态孤岛’,难以跨模态理解和设计。诺奖得主实验室走出的中国团队推出 ODesign 开源项目,将多模态分子纳入统一框架,展现跨模态迁移能力,团队创立英灵殿科技欲重构药物研发流程。
感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义
伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。