「大模型技术」共找到 10558 篇相关文章
再见,程序员!马斯克宣判:奇点就在2026
马斯克断言2026年是奇点之年,起因是Claude Code强大的编程能力引发关注。Claude Opus 4.5表现优异,碾压其他模型。奇点来临,人们工作方式将改变,AI或使软件开发自动化。
拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?
现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。
从华为“弃将”到打造两家上市公司,他如何成为中国“工控之王”?
过去二十多年,朱兴明打破欧美垄断,提升中国工业自动化核心零部件水平。他曾是华为员工,后创立汇川技术,带领其上市,还拆分出联合动力上市。他决策有得有失,如今又瞄准新领域。
仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式
中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。
Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法
阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。
GPU为什么能取代CPU,成为计算领域无可争议的核心?
过去CPU是计算核心,如今GPU凭借并行处理能力崛起。在人工智能、大数据等领域,GPU优势明显,软件支持也推动其普及。未来,GPU将在更多领域发挥作用,还会与CPU融合。
Jina官方MCP三板斧:搜、读、筛
Jina官方发布MCP服务器,将核心能力封装成LLM工具集。介绍工具功能、连接使用方法,给出问题排查方案,通过案例展示搭建工作流效果,评估不同模型,指出Agent瓶颈及MCP开放生态价值。
突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务
9月5日,Anthropic宣布禁止多数股权由中国资本持有的集团或子公司使用Claude。政策调整涉及多种中国背景企业,也适用于美“对手国家”,还意在遏制中方获取先进AI技术,引发行业关注。
编程“学废”了?普渡毕业却只获烤肉店面试!美国IT失业创新高:AI面试成最大屈辱,网友怒称宁愿失业!
随着AI编程工具普及和科技大厂裁员,美国计算机领域黯淡,应届生求职梦碎。2025年美国IT就业疲软,失业率创新高。毕业生陷入AI“恶性循环”,AI面试也让求职者体验糟糕,有人担忧信息泄露。
Vibe Coding爆火,YouWare靠「社区+产品思路」突围
AI时代,Vibe Coding兴起,谷歌DeepMind与OpenAI围绕AI Coding人才和技术博弈。YouWare创始人明超平洞察到AI Coding作品分享的断层,以「社区+产品思路」打造平台,在Vibe Coding领域突围。