「Gemini Robotics ER 1.6」共找到 2799 篇相关文章
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。
刚刚,UCLA周博磊也加入了一家机器人公司
加州大学洛杉矶分校副教授周博磊官宣加入机器人初创公司Coco Robotics,同时该公司成立Physical AI Lab,周博磊任首席AI科学家。Coco积累大量数据,想借此推进自动化研发,且与OpenAI有合作。
陶哲轩回应OpenAI新模型IMO夺金!GPT-5测试版也曝光了
OpenAI新模型在2025年IMO达金牌水平,GPT - 5也将发布。但陶哲轩指出缺乏统一测试标准,影响公平比较。MathArena测试中,Gemini 2.5 Pro仅13分,远低于铜牌线。
让AI自动构建AI模型:UCSD 推出 AIBuildAI 智能体,斩获OpenAI MLE-Bench榜单第一
近日,加州大学圣地亚哥分校研究团队开发 AIBuildAI 智能体,可全自动构建 AI 模型。它在 OpenAI MLE - Bench 基准测试 75 个任务上以 63.1% 获奖率居榜首,实现端到端自动化。
a16z全球AI产品Top100:AI入口之争已经打响,OpenClaw开启通用Agent时代
a16z发布全球AI产品Top100第六版更新,AI成主流默认功能,Gemini追ChatGPT凶猛,通用Agent登场。还介绍了各领域竞争态势、市场地理分布、创意领域演变等情况。
拒掉字节、谷歌橄榄枝,Meta 离职大佬田渊栋官宣自立门户!苏妈老黄追着投
Meta离职大佬田渊栋官宣创业,新公司Recursive Superintelligence首轮融资6.5亿美元,估值46.5亿美元。其团队堪称“硅谷AI梦之队”,想让AI具备“自我进化能力”,目标是扩展到多领域。
Android Studio 新功能上线,Compose 预览可调,开发者:终于不用盯着屏幕傻调尺寸了
最新发布的 Android Studio Narwhal 3 Feature Drop 带来功能增强,有可调整大小的 Compose 预览、新备份恢复工具等。支持 AGENTS.md 文件定制 Gemini 行为,还有图片附件和 @File Context 特性,提升 AI 集成与协同能力。
Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求
Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。
百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用
7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。
Google I/O 2026 | 开发者主题演讲精华集锦
在今年 Google I/O 大会上,谷歌发布 Gemini 3.5 系列模型,升级 '智能体优先' 开发平台 Antigravity,展示新工具和技能,助力开发者构建应用,还介绍了多项新技术及功能,另有招募活动。