开源开发者」共找到 4532 篇相关文章

产品应用7

胜率直逼人类大师!这套Agent揭开中国AI「玄学真相」

在无信息泄漏的术数题库中,Claude、GPT等主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用多Sub - Agent协作等策略,还在工具管理、规则使用等方面有创新。

新智元
产品应用8

国产新模王Qwen3.7-Max,海外开发已经沸腾了

阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。

AIGC开放社区
7

盘点丨百度那些悄咪咪下线的 AI 产品

AI时代个人创新创业相对简单,AI产品更新迭代快。作盘点百度下线AI产品,如心响、梯子AI等,分析下线原因,指出大厂做C端AI创新面临结构性矛盾,还提到成功转型的百度文库。

特工宇宙
开源动态8

跨越落地鸿沟!清华长三院发布首个真实场景AI竞技场,实战谁是最佳?

2026年AI产业冰火两重天,清华长三角研究院发布RWAI开源框架与“真实场景AI竞技场”。RWAI还原真实交互,实践效率高。竞技场重实际效能,产生多个赛道“擂主”,降低产业AI落地试错成本。

新智元
新闻资讯7

观猹 × MuSH | AI 练摊市集招募中,你的 AI 能让路人玩上 5 分钟吗?

5月15日上海举办MuShanghai AI Week,五天有不同主题活动。收官日有首个中外开发齐聚的Demo练摊市集,强调产品好玩,设投票机制和奖项,还分闪电秀PK赛与开放麦环节。

特工宇宙
算法论文8

DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测

文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源

力学与人工智能
开源动态8

AI编程代理的「插件时代」来了:一个程序员的.claude目录,一天涨了5500星

过去一周,GitHub Trending超半数项目围绕AI编程代理做‘技能扩展’。如Matt Pocock开源`.claude`目录配置文件,一天获5500星。多个同方向项目涌现,标志AI编程工具竞争焦点转向生态。

AI Reading Hub
开源动态7

AI 终于能"玩手机"了:Mobile MCP 让大模型直接操控你的 iOS 和 Android

Mobile MCP 是开源 MCP Server,让支持 MCP 协议的 AI 客户端操控 iOS 和 Android 设备,通过自然语言指令完成操作,解锁自动化测试等场景,但成功率有待提升,目前更适合探索性测试等。

AI Reading Hub
新闻资讯7

30天狂刷60万亿Token,光“榜一”就烧掉140万美元!Meta员工搞出“AI Token排行榜”,结果小扎连前250都进不了?

Meta员工开发“Claudeonomics”仪表盘统计员工AI Token使用量,引发“Tokenmaxxing”风潮,上线两天因数据“外泄”下线。30天内全公司Token使用超60万亿,“榜一”花超140万美元,扎克伯格未进前250。

AI科技大本营
新闻资讯7

Sam Altman在旧金山的豪宅刚刚被炸了,嫌犯还想烧掉OpenAI总部

当地时间2026年4月10日凌晨,OpenAI CEO Sam Altman旧金山豪宅遭汽油燃烧弹袭击,一小时后嫌犯又到OpenAI总部叫嚣。嫌犯被捕,Altman罕见公开家人合影表达对家人的爱,行业抗议威胁事件增加。

开源AI项目落地