「有监督微调」共找到 6465 篇相关文章
如何将LLM的"思考习惯"迁移到视觉领域?
传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。
刘璐也被Meta挖走了!华南理工校友,创造了4o吉卜力爆款
刘璐这位OpenAI研究员转投Meta,她创造了GPT - 4o吉卜力生图功能。她本科毕业于华南理工大学,曾参与Gemini研发。同时被挖的还有Allan Jabri。Meta专挖OpenAI华人,OpenAI仍有不少优秀华人研究员。
吴恩达YC演讲:AI创业如何快人一步?
吴恩达在YC演讲为AI创业者建议,强调执行速度是衡量创业公司成功的重要指标。他探讨AI技术加速工程和产品反馈等,还谈及AI创业机会在应用层,给出提升创业公司速度的方法等。
如何让AI帮你做前端自动化测试?我们这样落地了
本文介绍阿里基于AI的UI自动化测试框架在专有云质量保障的实践。框架用开源browser - use等工具,采用自然语言驱动用例、动态元素定位等机制,还应对了大模型幻觉等挑战,也提及构建企业级数据分析Agent方案。
2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高
推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。
用隐藏指令诱导AI给论文打高分,谢赛宁合著论文被点名:认错,绝不鼓励
最近,一些简单提示词在AI学术圈掀起风波,操作者将其隐秘嵌入论文诱导AI给高分。谢赛宁合著论文也涉此事,他紧急回应,承认过失,解释缘由并采取补救措施,还呼吁探讨AI时代科研伦理。
Devin 教你做 Agent:把 AI 当做需要指导的初级开发者
Cognition团队发布编程智能体实践指南,以把AI当初级开发者的心智模型为基础。介绍与智能体沟通原则及融入日常工作流的场景,还分初、中、高级给出任务处理方法,也提及局限性、使用建议和安全管理等内容。
AI 视频制作也接近了 GPT 时刻
AI产品有可用性易用性临界点,跨过该点即GPT时刻。纳米AI让AI视频接近此时刻,普通人用简单提示词就能做视频,其超级搜索基于多智能体架构,像小视频团队分工工作。
曾让 Adobe 豪掷千亿,如今要独立上市了!招股书疯狂点名 AI 150 次,新产品对标 Lovable
网页设计工具开发商 Figma 申请 IPO,招股书提“AI”超 150 次,既视其为“创意加速器”,也认为是“潜在威胁”。该公司业务增长强劲,今年扩展工具库,虽 AI 投入短期内有负面影响,但仍会加倍投入。
告别单一大模型依赖!北航等机构发布综述:大语言模型集成(LLM Ensemble)
北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三大集成范式。