「AI研究」共找到 10693 篇相关文章
狂揽6.9K star!!微软又来一款王炸项目,实时跟踪、透明可控,牛皮!
微软开源项目Magentic-UI狂揽6.9K star。它是“以人为本”网页智能助手,基于AutoGen框架,可让用户全程掌控,能实时跟踪、透明可控,有协同规划等功能,适合测试、分析等人员。
抢先体验GenFlow2.0:未来多Agent协作的理想形态
作者在百度邀测会抢先体验Genflow 2.0,用其解决小学教改信息查询问题,还让它生成创意图片。它得益于“沧舟OS”,有流畅、并发且跨模态能力,架构全自研,测试版亮点多,值得期待8月正式上线。
ACL首届博士论文奖公布,华人学者李曼玲获荣誉提名
自然语言处理顶会 ACL 公布首届计算语言学博士论文奖,获奖者是华盛顿大学的 Sewon Min,其论文聚焦大型语言模型数据使用。此外,还有三篇论文获提名,包括李曼玲等学者的成果。
为什么 Coze 把他们最核心的框架都开源出来了?
Coze开源了Coze Studio和Coze Loop项目,前者工作流完整,有工作流引擎和插件框架;后者可调试、优化Prompt。采用Apache 2.0许可,适合个人和企业,还介绍了参与开源项目的方法及开源原因。
隐形束缚:RLVR为何无法突破LLM的推理边界?
大型推理模型进展依赖带可验证奖励的强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存在“隐形束缚”,只能在基座模型初始能力内优化,难以发现新解。
UIUC提出隐式监督新范式:无需标注/RM即可全面提升多模态Reasoning的感知能力
大型多模态模型在复杂多模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知能力,无需额外标注,在多模态基准上表现优异,还解决了KL黑客问题。
垂直赛道 Agent 闷声发财指南:如何实现一年超千万营收?
本文围绕垂直赛道的2B Agent展开,分享了语核科技创始人的产品理念与经验,探讨了如何找到有价值的场景、构建高价值闭环。还介绍了客户的应用情况、对Agent的看法及选型考量,强调其商业价值与落地挑战。
Cursor调价风波背后:商业逻辑与用户期待的错位
Cursor在6月16日调整Pro计划收费模式,从请求数限制改为计算量限制,虽称优化却引发用户不满。用户发现服务缩水且沟通模糊,社交媒体上一片失望愤怒声。7月4日Cursor道歉并推出补救措施,但信任修复不易。
Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 和Gemini的20%
API开发者曝光Grok - 4和Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3和Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。
个人开发者时代崛起!22岁印度开发者搞的业余项目被马斯克Groq看上,如今用户破6万
22岁孟买开发者Zaid Mukaddam开发开源AI搜索引擎Scira,定位为“Perplexity替代品”。项目初期走红,后因流量激增成本上升,获Groq等公司支持。如今用户破6万,其成功激励更多开发者。