「模型优势」共找到 8428 篇相关文章
Claude 4如何思考?资深研究员回应:RLHF范式已过,RLVR已在编程/数学得到验证
Anthropic两位研究员在博客采访中透露Claude 4思考细节。提到可验证奖励强化学习RLVR在编程和数学领域获证明,探讨了RL扩展、模型自我意识等,还为大学生给出AI领域建议。
全新预训练数据筛选方案,让数据效率提升10倍!配置仅需fastText评分器|港科大vivo出品
香港科技大学和vivo AI Lab提出轻量级高效数据选择方法PreSelect,已被ICML 2025接收。它只需训练部署基于fastText的评分器,减少10倍计算需求,在多数据集实验中效果显著优于其他方法。
InfoQ 2025 年趋势报告:软件架构和设计
InfoQ 2025 年软件架构和设计趋势报告,借助《跨越鸿沟》模型分类。涉及 AI 多方面趋势,如 LLM 普及但应用场景存疑,还有 Agentic AI、SLM 等创新领域,以及 RAG、AI 辅助开发等不同阶段趋势。
拆解、对比与优化:LLM工具智能体的五种任务规划与执行模式
文章探讨了大语言模型驱动的AI智能体的五种任务规划与执行模式,包括ReAct、Plan-and-Execute、静态Workflow、Workflow+局部智能、模块化的分层规划,分析其优缺点、适用场景,还给出优化方法。
通义灵码编程智能体,上线!
近期 Qwen3 正式发布并开源 8 款「混合推理模型」,表现出色。通义灵码全面支持 Qwen3 并上线编程智能体,具备多种能力,支持配置 MCP 工具,集成魔搭 MCP 广场,能大幅提升开发效率。
Opus5.5 正在吃掉视频!分镜、动画、音效、配乐,它全做了
本文作者实测Claude Opus5.5的视频制作能力,除人工配音外,分镜、动画、音效、配乐全靠代码完成,对比GPT-6 Astra展示各环节提升,验证大模型全流程做视频的可能性。
1GW算力中心耗资600亿美元?黄仁勋G20现场布道“AI经济学”
美国当地时间9月2日,英伟达CEO黄仁勋在G20创新部长级会议阐述‘算力经济学’。他称建1GW规模AI基建约需500 - 600亿美元,算力成国家级核心生产资料,全球到2030年AI基建或达100GW。
2026世界机器人大会落幕,谁在物理AI赛道抢跑?
2026世界机器人大会落幕,具身智能从‘表演特技’转向‘实景作业’。物理AI世界正快速到来,但机器人量产尚需时日,AI汽车或率先实现人机深度协作,AIVA汽车以‘AI定义汽车’理念打造鲜活生命体,与火山引擎深度合作。
深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案
「豆包工作」作为面向生产力场景的Agent产品正式发布,与飞书深度打通,给出了目前Agent进入组织的最佳答案。主流办公Agent基础能力趋同,企业上下文正成办公Agent分水岭,豆包工作+飞书优势明显。
英伟达Vera Rubin首秀,DeepSeek V4 Pro 跑出30倍Agent吞吐
NVIDIA公布基于真实芯片的Vera Rubin性能测试结果,在针对Agent工作负载的测试中优势明显。SpaceXAI将部署其CPU,探索轨道计算。这显示未来AI竞争关键是支撑Agent的计算基础设施。