「基础开发框架」共找到 3479 篇相关文章
凌晨三点写代码、10个 Agent 同时跑!ClawdBot 创始人自曝 AI 上瘾史:Claude Code 入坑,Codex 成主力
Clawdbot(现名:Moltbot)爆火,其创始人 Peter Steinberger 分享开发经历。他曾打造 PSPDFKit,后经历职业倦怠。回归后用 AI 编程,从 Claude Code 入坑,Codex 成主力,还分享了 AI 重塑开发方式的见解。
对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准
文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务两维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。
零样本 Sim-to-Real !实现五指灵巧手力控抓取与手内操作
ByteDance Seed团队研究论文针对训练真实硬件控制策略难的问题,提出实用强化学习框架。该框架有完整Sim - to - Real方案,结合触觉反馈和关节力矩感知,在纯仿真环境训练策略,可零样本部署在真实五指灵巧手。
告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质
南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。
在微信中用 Google 登录,很难吗?
作者开发基于 LLM 的个性化实时快讯小工具,开发登录功能时发现微信里用 Google OAuth 登录失败,源于 Google 安全限制。众多产品有糟糕体验却未解决,作者用 Claude Code 轻松搞定,还分享 AI 编程观点。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多个问题模拟多任务推理场景。测试发现即便顶级模型如DeepSeek - R1在“高压”下准确率也骤降,该框架能揭示模型差异,为评测提供新范式。
刚刚,全球第一CRM收购AI Agent平台Moonhub
今日凌晨,全球第一CRM平台Salesforce收购AI Agent平台Moonhub,Moonhub团队将加入开发Agentforce。此前Salesforce已收购Informatica,其CEO看好AI Agent,愿景是到2025年底开发十亿个智能体。双方在HR智能体功能各有亮点。
从操作系统到Agent Team,字节Seed 2.0来了!
作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。
73%人类认同率!Video-Bench实现视频质量精准打分
上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频生成模型优化提供标尺。
10个小模型并联跑赢GPT-4.1!无额外训练,方法仅4步
上海人工智能实验室等机构提出Avengers框架,无需额外训练,通过四步集结小模型优势。实验表明,其在15个数据集上平均得分超GPT - 4.1,还探究了框架有效的要素,对AI研究和开源社区意义重大。