「ChatGPT - 5 Pro」共找到 2525 篇相关文章
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。
中国设计智造大奖作品展来了!从具身智能到智慧空间,打开未来生活想象
第十届中国设计智造大展在国美良渚校区开启,展示200余件获奖作品。展览设5大主题、打造新场景,验证新技术产业化应用,还展示增强外骨骼等案例,助力未来产业集群培育。
图灵奖大佬痛心:有人千万年薪,有人惨遭失业!25年全美疯狂裁员117万
2025年将尽,AI未带来美好,反致裁员失业。美国近5.5万岗位被AI取代,总裁员117万。图灵奖大佬Bengio、Anthropic CEO预警劳动力市场崩溃,人类需学习AI工具,从事创造性工作自救。
新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源
Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。
52个人用AI做PPT,年赚7个亿
在2025年,硅谷AI公司多“烧钱换增长”,Gamma却靠一款AI PPT工具,52人年入上亿美元,估值达21亿美元。它曾遇困境,后借AI逆袭,还分享独特运营哲学。
APP 上线 40 天后,Sora 核心团队分享了他们对于 AI 社交的关键思考
Sora APP上线不到5天下载达100万次,近200万周活用户中70%在创作。其核心团队分享对AI社交思考,介绍玩法、设计理念,还谈及推荐算法、创作门槛、商业化等方面规划。
多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准
香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。
71.2%的惊人解决率,伦敦大学开源顶级AI代码修复智能体系统
伦敦大学等发布Prometheus AI系统,它将代码库变成知识图谱,解决9种编程语言的GitHub问题。由五个智能体协作,解决率高、成本低且已开源,或为AI编程新方向。
让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器
当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。
Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法
阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。