「多工具调用」共找到 5578 篇相关文章
微软介绍了 TypeScript 7 的更新
微软分享 TypeScript 7 最新进展,披露用 Go 重写编译器计划,构建速度最高提 10 倍,降低内存占用。默认启用严格模式,是不兼容变更。开发者看法不一,有人赞性能提升,有人忧工具迁移。
谷歌成立AI基金,为初创公司提供技术、资金
谷歌宣布推出AI Futures Fund,旨在投资运用DeepMind AI工具的初创企业,提供技术、资金支持,如提前接触模型、专家指导、云服务积分和直接投资等,未透露基金规模。
切开Claude大脑,Anthropic称发现了一个类似人类意识的内部空间
Anthropic在Claude模型中发现J空间,其与人类大脑全局工作空间理论相似,承载特殊内容且可干预、参与多步推理等,但模型和人脑有差异,研究也有局限性。
AI 增强截图项目,爽歪歪~
日常截图后手动处理文字、公式、表格耗时又易出错。开源项目`Snippai`将截图与智能分析融合,是跨平台智能截图工具,能自动识别内容类型并处理,有多种功能,安装使用简单。
轻量高效,即插即用:Video-RAG为长视频理解带来新范式
现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。
Anthropic重磅更新skill-creator:创建skill全面告别“草台班子”时代
Anthropic升级skill - creator,让普通人创建skill更友好且有效。将测试等机制引入创作,能验证skill有效性。还支持多智能体并行测试、A/B测试,优化触发描述,为未来自然语言定义skill过渡。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
The Batch: 949 | 人形机器人进入工厂车间
少量人形机器人已进入工业场景,成本接近人力成本。Agility Robotics向Schaeffler提供Digit机器人,负责搬运箱子。目前工业人形机器人应用有限,多处于试点,预计到2040年数量将大增。
安卓彻底变了!Gemini接管所有屏幕,苹果连影子都没追上
谷歌在 Android Show I/O Edition 宣布,Android 从「操作系统」转型为「智能系统」,Gemini Intelligence 植入安卓设备,覆盖多硬件,还推出 Googlebook。谷歌端侧铺 Gemini,云端投 Claude,与苹果策略形成对照,竞争关键在分发。
创新中心| AI视觉创意不再拼“出图快”,而是拼“人味浓”?
北京AIGC视听产业创新中心位于朝阳区,是推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家伙伴。首创郎园拓展能力,项目延伸多地。