「Gemini Robotics-ER 1.6」共找到 2785 篇相关文章
告别工具焦虑:2026年真正值得用的8款AI效率外挂
文章指出2026年是‘AI深度融合’元年,工具使用进入‘重塑工作流’阶段。作者筛选出Gemini全家桶、OpenCode等8款‘硬核’AI工具,介绍其特点和优势,如多模态、不设限、易用等。
全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走
谷歌DeepMind的政治哲学家Iason Gabriel入职9年,发明的对齐框架影响Gemini训练决策。在AGI承诺与AI现实伤害间,他追问AI伦理。但技术部署快,6700亿美元涌入赛道,伦理红线被踩。
谷歌翻译重大更新:实时翻译,全球无障碍交流摩擦苹果
Google搜索产品副总裁宣布Google翻译引入Gemini模型,翻译能力飞跃。更新含顶尖文本翻译、实时语音对话翻译(Beta版)及扩展语言练习功能,适用多平台多语言,谷歌期待用户反馈以优化体验。
语音界Sora!微软刚开源新模型,一次生成90分钟语音、3200倍压缩率
今天凌晨微软研究院开源创新音频模型VibeVoice - 1.5B,有诸多技术突破,如可合成90分钟语音、支持4名发言人、3200倍音频压缩等,还首创双tokenizer协同架构。未来微软还会开源更大参数模型。
人类程序员依然远强于LLM:为什么说 AI 目前还差点火候
Redis之父Antirez的博文指出人类程序员远强于LLM。他修复Redis向量集缺陷时,与Gemini 2.5 PRO交流,虽其有帮助,但人类跳出固有思维解决问题的创造力是LLM难以企及的。
AI是「天才」还是「话术大师」?Anthropic颠覆性实验,终揭答案!
Anthropic新研究证实Claude模型有一定内省意识,能控制自身内部状态。用「概念注入」实验,Claude Opus 4和4.1表现最佳。不过该能力不可靠、局限大,未来进化情况待察。
抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅
视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在多类任务中显著提升性能,实现范式跃迁。
阿里又放大招!一句话,造一个能走进去的世界
阿里上线HappyOyster 1.0世界模型,一句话生成可实时探索、交互的开放世界。它与文生视频不同,能让用户参与体验。该模型有世界探索和实时导演两大功能,技术优势显著,应用场景广泛。
Claude Code迎来大更新:Agent能力增强
Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。
刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!
Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实性》,介绍缓解LLM撒谎的忏悔训练法、实验结果等,也指出其局限。