「视觉 - 语言数据」共找到 3778 篇相关文章
谷歌推出 LLM-Evalkit,为提示词工程带来秩序与可衡量性
谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让大语言模型提示词工程更有序可衡量。它整合实验、测试等环节,与谷歌云工作流集成,有无代码界面,已在 GitHub 发布。
忘记大模型,英伟达:小模型才是Agentic AI的未来!
截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA研究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。
ChatGPT惊现“零点击攻击”,API密钥被轻松泄露,OpenAI暂未解决
ChatGPT存在“零点击攻击”安全问题,攻击者可通过向第三方应用文档注入恶意提示,窃取用户敏感数据和API密钥。OpenAI虽采取防范措施,但攻击者仍能绕过。专家为企业提出防范建议。
实测Qwen-MT翻译模型,确实又快又好
阿里云百炼最新翻译模型Qwen-MT开放,有支持多语言互译、提供专业功能、轻量级架构等亮点。实测显示其响应快、回译准确、能调风格,200字文本仅需2.5秒。
北航LiveRepoReflection: 扭转乾坤-仓库级代码反射
本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力。
28岁辍学生掌舵Meta超级AI!小扎掷千亿,与奥特曼密谋,新「王」登顶
28岁的Alexandr Wang 19岁辍学,24岁成亿万富翁,现加盟Meta负责「超级智能」部门。他接受专访谈前沿思考,如智能体经济将至、人类成管理者、数据是瓶颈等,其理念有争议。
刚刚,SpaceX、英伟达宣布:AI数据中心要上天了
SpaceX与英伟达合作设计Starmind AI1卫星计算载荷,每颗卫星搭载NVIDIA GPU和CPU,将数据中心算力部署太空,该设计也用于地面数据中心。但项目投入大,还面临管理集群等难题。
这大概是我读过关于AI大模型最全面、好读又易懂的文章了
文章从神经网络入手,介绍其概念、学习过程,进而引出大语言模型,阐述其原理、训练方法,还提及AI浪潮下基础设施及大模型使用方式,如Agent、MCP等,展现神经网络和大模型发展现状与前景。
人脸机器人登上Science Robotics封面:用AI教会仿生人脸机器人「开口说话」
2026年1月15日,美国哥伦比亚大学工程学院研究登上《Science Robotics》封面,展示用AI让仿生人脸机器人“开口说话”技术。机器人经自监督学习,能将声音转自然唇动,有跨语言泛化能力,助其跨越“恐怖谷”。
稚晖君家智元没参展机器人大会,合着是人家自己办(doge)
这是智元机器人首届合作伙伴大会现场画面。前段时间世界机器人大会没智元身影,原来它有自己的大会。现场机器人表现多样,有比心、穿梭、自主讲解等,还有真机数据采集、流水线分拣等工作场景。