「端到端具身大模型」共找到 9131 篇相关文章
AI大模型浪潮下的认知重构:从一个数据老兵的转型思考
作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。
TypeScript“杀疯了”!60% 到 70%YC 创企用它构建 AI Agent,超越 Python 有戏了?
近日,Mastra AI 创始人称约 60 - 70% 的 YC X25 Agent 公司用 TypeScript 构建 AI Agent。该语言在 AI 应用开发优势明显,OpenAI 等也加大支持,但业内认为目前 Python 主导地位难被取代。
王兴兴回应比赛风波:挣到钱了,但现在的机器人别指望它能干活
2025北京智源大会上,宇树科技王兴兴、北京人形机器人创新中心熊友军等围绕具身智能探讨。提到机器人赛事能展示成果、促进行业发展;对机器人构型看法不一;还探讨了VLA泛化性等问题。
让ChatGPT连读“A”,直接崩溃到念广告词,网友:拿付费用户做测试呢?
ChatGPT付费用户体验高级语音模式时遇怪事,正常聊寿司时突然插播广告,连读“A”也会如此。网友猜测是广告插入或“幻觉”,OpenAI技术人员称是幻觉,而国产AI无此问题。
纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究
剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。
【5500字长文】AI出海一年简单回顾:从新手到养得起20人团队
AI技术+场景落地+出海,如何从零开始,用一年时间养得起20人团队?
看傻了!5k Star Canvas Editor,我被惊到啦~~~~
Canvas Editor是基于HTML `<canvas>` API的文档编辑器,自己控制绘制、分页、交互和导出。文章介绍其与普通编辑器差异、核心能力、适用场景、接入代码,也指出项目限制,认为它是架构新选择。
一键分享=全网公开?Claude 被曝聊天记录可在谷歌直接搜到
2026 年 7 月 26 日,Reddit 用户称用谷歌站点检索语法能调出 Claude 用户共享对话记录。因 Claude 未补全防护配置,致用户加密资产、身份等信息泄露。此前 OpenAI、Grok 也有同类问题,社区呼吁平台完善防护体系。