「线下渠道」共找到 973 篇相关文章
训练效率提升25%、成本降23%!上海期智研究院、算秩未来联合推出MegatronApp:专为万亿参数大模型训练打造的系统工具包
上海期智研究院联合算秩未来在WAIC 2025大会发布开源项目MegatronApp,它是国内首个围绕Megatron - LM的增强工具链。经实际数据,其在该框架下训练效率提25%、成本降23%,含四大模块解决训练难题。
金融智能体落地四阶段,同花顺Agent战略与实践全景
在数字化与 AI 驱动下,金融行业变革正酣。同花顺产品总监路忠文解析 AI Agent 在金融领域实践,结合案例揭示其突破传统业务边界的潜力,探讨落地挑战与趋势,还分享了公司自身 AI 探索历程与实践经验。
颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出
在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由大模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。
快问快答|AI都会写代码了,还要不要报考计算机专业?!
在AI大模型能写代码的背景下,InfoQ采访王昊奋、谭晓生、邹欣,探讨高考是否报考计算机专业。他们就专业前景、核心价值转变、核心能力等发表看法,还提及课程调整和其他专业选择。6月30日直播将深入探讨。
谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!
当地时间 6 月 23 日,Linux 基金会宣布与多公司成立 A2A 项目,由谷歌捐赠协议规范等。A2A 支持智能体通信协作,谷歌称其将在中立治理下开发普及。此外还对比了 A2A 与 MCP、ACP 等协议,探讨实际应用问题。
无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码
港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。
直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?
该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。
嗑药、家暴、跳楼!纽约时报曝光恐怖细节:ChatGPT 正让人们付出生命代价
《纽约时报》调查揭露,越来越多ChatGPT用户在对话中失去理智,出现嗑药、家暴、自杀等行为。如会计师停药嗑药,母亲为AI殴打丈夫等。研究显示,GPT - 4o在68%的情况下会肯定用户的精神病性妄想。
奥特曼:温和奇点已降临!AI最终掌控物理世界,2030年人类命运大转折
奥特曼在「温和的奇点」一文中称人类跨越AI发展「事件视界」,进入指数级加速阶段。他预测了未来5年技术时间线,还指出奇点悄然渗透,AI自转飞轮越来越快,人类迈向超级智能时代机遇与挑战并存。
AI 渗透金融行业:大模型如何破解风控、服务与决策难题?
在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨大模型赋能金融,涉及风控、服务、决策等难题,分享了大模型应用场景、技术渗透、权衡可解释性与性能等观点。