自主智能测试」共找到 5117 篇相关文章

开源动态8

社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型

Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。

Hugging Face
开源动态7

谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!

当地时间 6 月 23 日,Linux 基金会宣布与多公司成立 A2A 项目,由谷歌捐赠协议规范等。A2A 支持智能体通信协作,谷歌称其将在中立治理下开发普及。此外还对比了 A2A 与 MCP、ACP 等协议,探讨实际应用问题。

InfoQ
产品应用8

国内首张防爆资质、全球首个加油大脑方案,他们凭什么拿下两个「第一」

今年是具身智能商业化落地关键年,深圳若愚科技携自研「若愚九天机器人大脑」及特种防爆机器人「若愚揽月 01」亮相。其拿下国内首张防爆资质,推出全球首个加油大脑方案,在多场景验证能力,技术有多项创新。

机器之心
开源动态8

美团开源全模态,比肩顶级闭源模型,开源新SOTA

美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。

AIGC开放社区
新闻资讯7

谷歌约战,DeepSeek、Kimi都要上,首届大模型对抗赛明天开战

太平洋时间8月5 - 7日,8款前沿AI模型将在Kaggle Game Arena展开为期3天的国际象棋比赛,参赛方都是AI界顶流。谷歌称现有基准测试难跟上模型发展,这场比赛是探索新评估方法。赛制为单败淘汰制。

机器之心
新闻资讯7

刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。

机器之心
算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
新闻资讯7

ChatGPT的第一块广告位,被谁买走了?OpenAI:别骂,我们这次所有底线都招了

OpenAI宣布将在ChatGPT测试广告,以标注“赞助”链接形式出现在回答底部,不影响回答内容。广告仅对免费版和Go套餐用户展示,OpenAI称广告收入占比将低于总收入一半,还说明了广告原则等情况。

AI前线
新闻资讯7

OpenAI发布GPT-5.1 Codex Max,编程能力比Gemini 3更强、更持久

为换回注意力,OpenAI紧急发布GPT - 5.1 Codex Max。它在编程测试中表现优于Gemini 3 Pro,还实现24小时项目级开发。引入自动压缩与扩展推理改进,效率提升,现已多途径可用,API访问将开放。

AI工程化
产品应用8

终于,TRAE SOLO全量开放,我们用它复刻了PewDiePie的大模型智囊团

2025年AI Coding赛道上,TRAE是国产AI IDE代表作。7月其SOLO Beta版反响好,如今正式版全量推送。它定位为‘具备响应感知的编程智能体’,新增功能,还限时免费体验,实测显示开发能力强。

机器之心