「基础模型研发」共找到 8370 篇相关文章
The Batch: 849 | 用于训练网页智能体的生成数据
开发网页智能体常需大量人力标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法。
一文带你彻底理解AIGC、Agent、MCP的概念和关系
本文为非AI开发者科普AIGC、Agent、MCP概念和关系。AIGC用AI生成内容;Agent可自主决策调用工具;MCP是Anthropic开源协议,降低模型与工具集成成本,获大厂支持。
研究表明:资深开发者在使用AI工具时,完成任务的时间比不使用时延长了19%。
研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间比不使用时延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。
李飞飞曝创业招人标准!总结 AI 大牛学生经验,告诫博士们不要做堆算力项目
近日,“AI教母”李飞飞接受采访,指出当前AI繁荣有局限,其初创公司World Labs将攻克空间智能。她回顾ImageNet项目,讲述AI发展历程,还分享创业招人标准、给博士建议等内容。
回复:用 AI 辅导教学问题
家长询问用Gemini 2.5 pro的OCR功能辅助孩子预习九门课程的问题,包括撰写提示词、有无更合适AI方案、家长角色及评估学习成果等,回复给出对应建议,如没必要上传教材等。
Agent RL和智能体自我进化的关键一步: TaskCraft实现复杂智能体任务的自动生成
当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务的数据集,支撑智能体训练评估。
8.6K star!!实时翻译、离线使用、支持50+语言,这个免费开源项目牛皮!
介绍开源项目RTranslator,它为Android平台实时翻译应用,用Meta的NLLB模型与OpenAI Whisper技术,本地处理保障质量与隐私。有双模式对话等功能,在Github获8.6K star。
Snowflake:企业对AI投资回报率高达41%
全球著名数据库云平台Snowflake发布调查报告,对9个国家超500人企业调查发现,已部署生成式AI企业平均ROI达41%,应用广泛但面临数据挑战,不同行业和区域表现有差异,多数企业计划增预算。
告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越
传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。
Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。