「AI技术周」共找到 10941 篇相关文章

算法论文8

综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满

该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。

深度学习自然语言处理
算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

文章记录了GPT - 5的发布情况,介绍其系统构成、减少事实幻觉和谄媚行为等改进,也提到跑分、性格设置等。实测发现写作和情商不如GPT - 4.5,但编程能力强,还感慨AI发展之快。

数字生命卡兹克
新闻资讯7

AlphaGo开发者创业挑战DeepSeek,成立仅一年目标融资10亿美元

前谷歌DeepMind成员、AlphaGo开发者创立Reflection AI,要开发开源大模型挑战DeepSeek,目标融资10亿美元。其已发布智能体Asimov,较其他模型更受用户偏好,还能捕捉隐性信息,已获少量企业收入。

量子位
推荐文章7

人生周报v035:我和你

本周人生周报分享了即刻、X平台上对AI时代产品与服务、人性、社区氛围等观点,推荐《我和你》,还输出对生活、思考、创作等方面感悟,如把一天当一生过、当答案免费问题无价等。

李继刚
推荐文章8

关于 Multi-Agent 到底该不该做,Claude 和 Devin 吵起来了

有两篇多智能体文章引发热议。Anthropic分享多智能体研究系统构建经验,指出适合特定任务;Cognition认为当下AI Coding暂不适用多智能体。文章还介绍多智能体架构、提示词原则等内容。

Founder Park
算法论文8

73%人类认同率!Video-Bench实现视频质量精准打分

上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频生成模型优化提供标尺。

深度学习自然语言处理
推荐文章8

5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson

大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。

海外独角兽
8

Cloudflare CEO 警告:未来两年,Agent 会让互联网每周爆出一个 Log4j

Cloudflare CEO Matthew Prince在播客中指出,互联网上Bot流量已超人类,未来五年或暴涨1000倍,旧商业模式将崩塌。他还谈到AI对安全、工作的影响,以及公司转型、互联网未来商业模式等问题。

InfoQ
算法论文7

OpenClaw爆火背后,仅8.6%用户能察觉异常!多校联合实证

OpenClaw等AI智能体爆火,其安全隐患凸显。多校联合研究发现,仅8.6%的用户能感知智能体媒介欺骗,总结了6类认知失效模式,认为体验式学习或比静态提醒更能提升用户警觉性。

新智元