商汤大装置」共找到 5142 篇相关文章

算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着语言模型发展,多智能体系统潜力但失败率高。新加坡国立学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
新闻资讯8

刚刚,OpenAI发布白皮书:如何在AI时代保持领先

AI发展超多数企业适应能力,早期采用者收入增长更快。9月3日OpenAI发布白皮书,总结与企业合作经验,给出从战略到治理的五核心原则及多方面重点建议,助企业在AI时代保持领先。

机器之心
新闻资讯8

Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理会首日精彩速览

8月15日,2025全球产品经理会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。

AI科技大本营
产品应用8

实测对比!扣子空间播客功能完爆 NotebookLM,覆盖场景更

多模态是模型热门应用概念,文本生成语音赛道受资本青睐。作者实测对比扣子空间和NotebookLM,发现扣子空间播客功能更优,能精准拿捏尺度,覆盖场景,还能做旅行攻略、生成网站等。

InfoQ
开源动态8

一个LoRA实现GPT-4o级图像编辑!浙哈佛新模型冲上Hugging Face榜二

随着Gemini、GPT - 4o等把基于文本的图像编辑推向高峰,提高性能常需量数据和参数量模型。而浙哈佛团队提出ICEdit,用少量数据和参数实现高质量图像编辑,媲美甚至超越商业模型。

新智元
开源动态9

刚刚,Kimi K3开源!3万亿模型权重全球开放

2026年7月27日,Moonshot AI开源全球首个3万亿参数级模型Kimi K3。它不仅参数量,还在多领域表现出色,能与顶尖闭源模型媲美。其架构创新、训练独特、推理成本低,有望改变全球模型格局。

新智元
开源动态8

GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!

GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。

量子位
开源动态8

AI医生终于有了硬标尺!全球首个专病循证评测框架GAPS发布,蚂蚁联合北王俊院士团队出品

蚂蚁健康与北王俊院士团队发布全球首个模型专病循证能力评测框架GAPS及评测集GAPS - NSCLC - preview,解决现有医疗AI评测局限,成果已应用于“蚂蚁阿福”,并客观评价了模型临床能力。

量子位
新闻资讯7

AI为啥不懂物理世界?李飞飞、杨立昆:缺个「世界模型」,得学脑新皮质工作

近来,杨立昆计划离开Meta创立以‘世界模型’为核心的AI公司;此前李飞飞也发文指出语言模型弊端,强调建立‘世界模型’重要性。该模型源于对语言模型局限的反思,能让AI理解物理世界。

量子位
新闻资讯7

Yann LeCun终于被小扎“逼得”离职创业了!内行被外行指导、时刻担心被裁,Meta 人现在迷茫又内卷

据《金融时报》报道,Meta 首席 AI 科学家 Yann LeCun 计划离职创业。他对 Meta 内部变化不满,与扎克伯格在 AI 路线有分歧。Meta 近年动荡,员工迷茫内卷,高层决策引诸多问题,还要求元宇宙部门用 AI 提效。

InfoQ