「Pi0.5」共找到 2733 篇相关文章
Claude两个新模型实测流出!空间推理封神,算力直接榨干了
Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。
GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平
香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。
刚刚,DeepSeek多模态技术范式公布,以视觉原语思考
DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。
这周六,聊聊具身数据、模型与落地场景|沙龙报名
当下具身智能进入加速期,但具身模型从Demo走向真实世界运行路径复杂,存在技术路线未收敛、数据匮乏等问题。量子位等联合发起沙龙,4月25日周六14:00,一线从业者与研究者将分享经验,探讨具身智能关键环节。
开发效率狂飙十倍!Claude托管智能体功能改写应用落地速度
Anthropic上线Claude托管智能体功能,让开发者告别底层基建搭建,只需几天就能让业务级智能体投入生产。该功能有四大核心流转模块,多家企业使用后效率大幅提升,还介绍了接入细则。
记录下SGLang开发,优化,debug的技巧之大SKILL时代已来临
文章记录SGLang开发等技巧,介绍Agent在编程开发领域的强大能力,如完成多种工作、提升模型速度。还提及Agent流程优化方向,提醒警惕其偏差,指出人的价值转变,成为设计、把关和提炼者。
中美科技博弈下的生存法则
中美科技博弈围绕原创型创新、应用型创新、技术自主与安全、全球影响力构建四大维度展开。中国在部分领域实现局部反超,应用创新优势明显,但在科学前沿仍需追赶。文章还探讨了半导体、能源资源等方面的挑战与策略。
一行代码不写,龙虾军团日夜为我打工赚钱
油管科技博主Matthew Berman分享0代码OpenClaw使用心得,其龙虾数字员工能处理商务邮件等工作。他靠提示词+Vibe Coding实现‘躺赚’,还分享多场景龙虾玩法,且公开提示词。
Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局
Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。
像Vibe Coding一样写论文!OpenAI发布免费科研写作平台
OpenAI发布免费科研写作平台Prism,将GPT - 5.2集成到在线LaTeX编辑器,功能强大。其背后是OpenAI进军AI4S领域战略,副总裁Kevin Weil称2026年将成科学界‘AI变革年’。