「工具使用」共找到 2844 篇相关文章
Marble登场!告别不稳定与变形,持久探索3D世界
李飞飞团队World Labs推出Marble并开放有限测试预览,基于图像或文本提示可生成3D世界,具有持久、稳定、风格多样等特点。用户能导出使用,在浏览器自由导航,虽有局限但潜力大。
实测updream预演台:一张图,换来一整个3D片场!
作者实测updream预演台,它可传图自动重建3D白模场景,可摆人物、调机位等,再配合Seedance 2.5渲染成片。作者还做了对照实验,证明白模能锁定拍摄意图,并给出使用建议。
Vercel 发布新语言 Zero:代码不是写给人看的,而是写给 AI 的
Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智能体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,不过在 Hacker News 上遭部分质疑。
Copilot 创始工程师:大多数 AI 编码“就像开着法拉利去买牛奶一样”
GitHub Copilot 创始工程师 Neel Sundaresan 正构建智能编码工具 IBM Bob,已有 8 万 IBM 开发者使用。他认为多数 AI 编码像开法拉利买牛奶,Bob 会按需调度模型,他还谈及智能体市场变化与风险。
Agent群体智能来了!魔搭开源Agent自进化群体智能框架:群体记忆自动蒸馏与进化,8万+群体技能即取即用,智能体画像一键复用
个人或团队部署使用智能体面临状态易失、重复试错、迁移困难等痛点。魔搭ModelScope团队开源的Ultron框架,补上群体协作基础设施,解决经验沉淀、技能进化和画像共享问题,提升智能体协作效率。
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
从传统编程转向大模型编程
文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。
The Batch:827 | Claude 4 推动代码生成能力再升级
Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。
Sonnet 5 翻车!同性能价差最高 56倍,海外巨头为何复刻不出 DeepSeek?
Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。
为老父亲做的桌面 Agent,不小心在 GitHub 霸榜一周
OpenHuman是TinyHumans AI构建的开源桌面AI Agent,登上GitHub榜单并霸榜一周。它想成桌面级个人AI操作系统入口,但使用体验与愿景有差距,工程架构有亮点,也存在安全风险,其产品哲学有价值但执行粗糙。