「飞桨v3.2」共找到 3715 篇相关文章
刚刚,首个空间原生的具身视觉基模开源!机器人更会看我们的世界了
蚂蚁灵波发布并开源了面向机器人真实任务的空间原生视觉基模 LingBot-Vision 及空间感知模型 LingBot-Depth 2.0,能让机器人更精准地感知世界,解决透明反光材质、小目标和远距离目标等视觉难题。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
十三年布局,一朝反超!谷歌AI崛起的真实故事
2025年谷歌多款AI成果表现亮眼,如Nano Banana登顶、Gemini App下载量第一、Gemini 3超ChatGPT。这场逆袭始于2012年太浩湖竞拍,之后谷歌收购DeepMind、发明Transformer、自研TPU芯片,虽历经波折,终在2025年反超。
思考已成白菜价?黄仁勋一语成谶,物理学家:人类科研只剩3年
德国物理学家Sabine Hossenfelder预言,3年内熟悉的科学研究将不复存在,因AI能低成本、短时间取代人力。现实中AI已提升科研效率,国家与巨头也在推动,同时它会摧毁旧科研模式并重塑新范式。
突然发现,谷歌的 AI Mode “免费、全面”地开放了
上个月谷歌在 iOS 和安卓的 Google App 全面开放 AI Mode,现几乎对所有能访问 google.com 的地区免费开放。它基于 Gemini 2.5 等模型,能智能答问、对话交互,还植入 Agent 功能,变革搜索体验。
Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆
由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。
OpenAI头号叛徒,竟然是自学的AI???
Anthropic联合创始人Tom Brown分享AI奋斗史,他大学线性代数仅B-,自学6个月AI后进入OpenAI,后与前同事创立Anthropic。Claude 3.5 Sonnet让其有与OpenAI竞争底气,市场份额反超,还对OpenAI多番反击。
Vercel Zero 引发争议:AI 时代真的需要一门新语言吗?
Vercel 推出 v0 API,让开发者能以编程方式访问其 AI 应用构建智能体,支持多种请求与外部工具。它将应用构建智能体作为基础设施开放,社区关注其对全程可编程应用开发的支持潜力。
The Batch: 938 | Gemini 的音乐生成器
Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持多语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。
完爆ChatGPT!谷歌这招太狠:连你的「阴阳怪气」都能神还原
谷歌发布Gemini 2.5 Flash原生音频模型,可保留语调进行实时语音翻译,实现拟人化交互。还具持续监听、风格迁移等功能,提升开发者所需的函数调用、指令遵循等能力,另有实验产品Disco。