「中科大」共找到 6823 篇相关文章
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。
GitHub 23.6k star 的 BMAD Method:如何把大模型系统提示词,变成一支“可复制的 AI 开发团队”?
BMAD Method是开源的AI驱动敏捷开发方法论与工具集,基于BMAD Core框架,有19个专业AI角色和50+条工作流,获23.6k颗GitHub Star。它解决了大模型使用痛点,将AI开发工程化,可在多工具复用。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。
X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态大模型,在20+个图像分割数据集上均达SoTA
中山大学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态大模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在超20个数据集达最优,为图像分割研究开辟新方向。
蛰伏三年,前大疆员工做了款消费级纺织机,拿下红杉、顺为、米哈游等数亿融资|产品观察
浪爪智能创始人胡文鑫出身大厂,却投身家用纺织机赛道。公司已获数亿融资,2024 年推出自动簇绒枪,还打磨消费级纺织 Station 平台,即将发布新品并搭建社区。团队解决诸多技术难题,满足不同用户需求。
豆包大模型2.0+Claude Skills,3步装好,终于有AI能帮我"看视频做笔记"了!火山引擎全系列可用!
传统视频总结工具只基于音频总结,内容浅显。而豆包大模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“看”视频,输出详细笔记。
SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究
当前推理模型在基准测试中性能卓越,但在密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。
62岁软件教父Martin Fowler警告:AI泡沫下,裁员潮印证行业萧条,大模型正将编程拖入“非确定性深渊”!
62岁软件教父Martin Fowler在The Pragmatic Engineer节目中谈AI对软件开发的影响。他认为当下行业萧条,AI有泡沫,编程从确定性转向非确定性带来挑战,也催生新工作流程,还强调测试、重构等的重要性。
《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造
研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。
大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一
多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。