「论文分析」共找到 2013 篇相关文章
万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021
雷峰网&AI科技评论邀三位老师探讨“AI大模型金融应用的机遇与挑战”。以Trading Arena大赛为例,分析大模型在金融投资应用,指出打造强逻辑推理“大脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。
AI Agents和Agentic AI有什么区别?
论文《AI Agents vs. Agentic AI》深入探讨AI Agent和Agentic AI的本质差异。AI Agents是集成大模型和外部工具的单体系统,适合简单任务;Agentic AI是多智能体协作新范式,适合复杂场景。还提及挑战、解决方案与未来方向。
本周推荐的6个yyds的Github开源项目!
文章推荐6个GitHub开源项目。如Stretchly是休息提醒工具,助打工人养成科学节奏;Yaak是API客户端,主打离线隐私;ValueCell用于金融AI分析交易;nof1 - tracker可跟单交易;Zerox转换文档为Markdown;Open Notebook是Google Notebook LM平替。
DeepMind AlphaProof 前负责人谈2025年IMO
前Google DeepMind AlphaProof项目联合负责人Rishi Mehta发布关于2025年IMO结果的分析。今年OpenAI和Google DeepMind双双宣布达到金牌水平,解法各有特点。Mehta预测前沿大语言模型明年或开箱即用获奖牌,未来6个月内或攻克非平凡开放数学问题。
【DeepSeek-OCR系列第一篇】Language Modelling with Pixels【ICLR23】
当前主流语言模型依赖固定词表,扩展到多语言、多脚本时面临覆盖受限、计算昂贵、鲁棒性差等问题。ICLR 2023论文提出不依赖词表的PIXEL模型,通过将文本变成图像用视觉Transformer理解,实验验证其有跨语言、抗噪声等优势。
Hexstrike AI的安装及交互跟踪环境
Hexstrike AI是基于专业化Agent协同的智能渗透测试系统,有强大自动化攻击能力。文章介绍其安装方法,包括服务端和客户端配置,还提及搭建跟踪系统及后续计划,将深入分析专业AI代理原理及关注v7.0新功能。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!
论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。
算法1年翻倍,芯片2年翻倍?重磅实锤:AI正在自我加速,拦不住了
NBER论文证明AI研发自我加速反馈环强度远超其他科技领域,芯片效率每2年、算法效率每1年翻倍。部分自动化就能引爆反馈环,全行业13%自动化率或软硬件17%自动化率可触发奇点,6年内AI可能实现自我迭代。
Auto Research时代,AI Scientist的第一场药企实习考验|甲子光年
AI Scientist从大模型做题家进化为自动化科研助手,但从demo到应用面临买单难题。Phylo等团队构建BiomniBench评估框架,让AI做药企真实数据分析,结果显示AI表现超人类实习生,且有速度和成本优势,但也存在偏科问题。