「多语言模型」共找到 9938 篇相关文章

开源动态8

Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软

长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。

量子位
新闻资讯8

突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
推荐文章7

A 路径 VS B 路径:先攻新加坡还是直取美国?中国科技出海的生死选择题

文章围绕中国科技出海展开,对比 A、B 路径,分析中美市场特点,指出中国软件市场是试炼场,还阐述开源项目全球化路径,认为新加坡可作出海首站,最后推荐 AICon 北京站活动。

InfoQ
新闻资讯7

WWDC 2025 让大家“失望”了?no!苹果在下一盘AI大棋

苹果WWDC 2025未推出预期AI应用矩阵,股价下跌引失望。但实则是深思熟虑之举,它开放端侧模型及工具,让开发者创新,规避风险,待AI成熟凭借优势“后发先至”。

AI工程化
推荐文章7

我在Facebook工作四年的总结与反思

作者分享在Facebook四年工作的总结反思。包括目标规划、工作价值判断、处事态度、技术与产品关系等多方面体会,如明确目标、做有价值工作、少片面结论等。

海边的拾遗者
产品应用8

Cursor这波1.0升级,真的要把程序员饭碗摔碎了~

今天Cursor 1.0硬核发布,跨越多个版本。它集成主流MCP、Memory、Agent技术,有BugBot自动代码审查等功能,支持Jupyter Notebook集成,聊天界面体验也更丰富,大幅提升开发生产力。

PaperAgent
新闻资讯7

突发!Reddit起诉Anthropic,非法访问10万次

华尔街日报消息,Reddit起诉大模型平台Anthropic,指控其非法访问网站10万次,用用户数据训练AI。Reddit称已和OpenAI、谷歌达成合规合作,此次起诉为求赔偿并让Anthropic履约。

AIGC开放社区
开源动态8

微软开源2周狂赚7.2K star!!轻量好用命令行编辑利器,程序员力荐!

微软开源命令行文本编辑器`Edit`,专为Windows Terminal设计,支持多系统。它轻量高效,功能丰富,兼容Windows生态,还有鼠标模式。开源半月获7.2K+ star,提供多种安装方式。

开源先锋
产品应用7

这样更公平:用jina-reranker-m0为多模态文档打分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
开源动态8

红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用

红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。

Founder Park