「数据集构建」共找到 4087 篇相关文章
云计算一哥,刚刚重新定义了AI Agent的玩法
亚马逊云科技在纽约峰会上重新定义AI Agent部署方式,发布Amazon Bedrock AgentCore工具包,还推出Marketplace中的AI Agents和工具、Amazon Nova定制化功能等,在数据层和编程应用也有新动作,展现其AI Agent战略布局。
通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角生成
去年Sora等模型革新视频生成领域,相机可控的视频生成技术是构建世界模型核心。但从单视角生成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频生成新视角视频,多方面表现出色。
多智能体在「燃烧」Token!Anthropic公开发现的一切
Anthropic发布多智能体研究系统构建解释,解决多智能体研究困惑。多智能体系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示词工程、评估方法、面临的工程挑战等内容。
拒绝强行AIGC!| 一种安全实用、准确率高的Text2Sql方案
在金融、医疗等对精确性、透明度和安全性要求高的领域,完全依赖大模型NL - to - SQL能力易出错。本文提出基于函数调用LLM的新范式,将LLM能力聚焦于调用预定义功能函数,提升了数据检索的准确性、透明度和可维护性。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。
阿里Qwen3一口气开源多个向量&排序模型,冲!
今天阿里正式开源Qwen3-Embedding和Qwen3-Reranker系列,为多语言文本嵌入和相关性排序树立新标杆。提供0.6B/4B/8B三种版本,支持119种语言,在多个数据集达先进性能,赋能多种应用场景。
Agent版Hugging Face来了,openJiuwen发布首个开源智能体资产平台
当前Agent能力多局限于单次会话,难以沉淀复用。华为联合多方打造的开源AI Agent平台openJiuwen,发布业内首个开源智能体资产平台,将Agent能力拆分为五类可复用资产,构建完整生态闭环,推动生产级Agent落地。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
12K Star 的 claude-seo:免费 SEO 审计能替掉哪些付费工具
2026年2月底GitHub上claude - seo仓库有3500 star,五个月后达12.3K star。该项目作者一人开发,能给站点做SEO审计。它把判断层抽出开源,审计后可直接改代码。不过也有动态渲染弱等问题。
Slack 淘汰 SSH:700+ EMR 作业迁移至基于 REST 的调度架构
Slack 完成大规模数据平台改造,将 Amazon EMR 数据处理流程中 SSH 作业执行模式替换为基于 REST API 的统一调度架构,移除对生产集群的直接 SSH 访问,迁移 700 多个 Airflow Operator,解决了安全、运维等问题。