「RoboBrain 2.0 Pro」共找到 2723 篇相关文章
像Vibe Coding一样写论文!OpenAI发布免费科研写作平台
OpenAI发布免费科研写作平台Prism,将GPT - 5.2集成到在线LaTeX编辑器,功能强大。其背后是OpenAI进军AI4S领域战略,副总裁Kevin Weil称2026年将成科学界‘AI变革年’。
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。
谷歌AI逆袭背后的头号功臣
2025年谷歌AI打翻身仗,Nano Banana和Gemini 3 Pro两款模型抢了OpenAI大量用户。背后功臣Josh Woodward临危受命,让Gemini应用打败ChatGPT。他还孵化多款AI产品,重视细节与社会责任。
Hinton最新预言刷屏:谷歌必赢,而且「早该赢了」!
Google凭借Gemini 3、自研芯片、强大数据与研究团队,正在重新超越OpenAI。辛顿认为谷歌会赢,且早该赢了。Gemini 3 Pro在多方面表现出色,而ChatGPT增速放缓,OpenAI面临挑战。
我的AI OS搭建思路
作者黄益贺分享AI OS搭建思路。其系统以Claude Code为框架、Kimi K2 Thinking为模型,通过Skill和自定义命令满足工作需求,设计三层文件夹体系处理信息,供大家参考搭建。
Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法
阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。
从组件到系统,Agent 的 Evaluation 怎么做?
Agentic AI 兴起使 Agent Evaluation 成热点。评估 Agent 与 LLM 有本质区别,Agent Evaluation 要考察系统在动态环境实现目标的综合表现,传统 LLM 评估方法无法沿用。业界涌现 GAIA 等相关工作,评估范式也在不断演进。
真够卷的!DeepSeek更完智谱更:GLM-4.6,代码国内最强
前脚DeepSeek更新到V3.2,智谱又推出GLM-4.6,代码能力达国内最强。测试显示其在多方面表现出色,还降低平均token消耗。寒武纪、摩尔线程跟进适配,价格也降低。
Claude Sonnet 4.5来了!能连续编程30多小时、1.1万行代码
十一假期前,DeepSeek 开源新模型 V3.2 - Exp,深夜 Anthropic 发布 Claude Sonnet 4.5,自称世界最好编码模型,自主编码时长超 30 小时,还带来系列产品升级,在多方面表现优异。