「视觉智能工坊」共找到 3944 篇相关文章
秘塔AI放大招!「边想边搜边做」,内置20+智能体,想法一键实现
在AI浪潮下,搜索正经历重构。秘塔AI推出「Agentic Search」模式,「边想边搜边做」,可自主完成多步工具调用,内置20余种工具。通过5个场景展示升级,从读懂用户到美化结果、精准计算、打通工作流等,让搜索进化为「帮达成」。
阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元
阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。
AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战
2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。
OpenAI董事长Bret Taylor:2010 年的 SaaS 应用,就是 2030 年的智能体公司
OpenAI董事长Bret Taylor在对话中称,当下处于“加10倍速的互联网泡沫”时代,AI为初创公司带来挑战巨头的机会。他直言多数B2B公司“以客户为中心”是胡扯,还为AI创业者划红线,如应用公司预训练模型是烧钱。
千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战
多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。
2025 年 AI 编程趋势:智能体 10 倍生产率放大下的“粪围”蔓延
文章指出 2025 年是体系化跃迁起点,AI 编程工具不断升级。AI 代理能力超代码补全,编程从‘代码直生’转向‘计划先行’,自动验证增强,还有异步化、团队协作等趋势。但 AI 重构有问题,还会放大技术债。
CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测
香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。
【明日开幕】山洋平个展《风铎》,观一场视觉风动|三影堂厦门
Ropedia刘子纬:具身智能的Scaling Law,不是算力,是人类的经验
Ropedia刘子纬指出,当前物理AI面临差距,下一阶段需Scaling人类物理世界的经验。Ropedia构建真实世界经验引擎,形成经验飞轮,目标是打造能看见、记住、想象并行动的模型。
ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架
西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。