第一批转行做FDE的人,赚肥了
深度长文FDE(前沿部署工程师)成AI最火新岗位,驻场帮企业落地大模型。硅谷年薪17万美元起,国内大厂最高百万,个人接单月入可达10万。但客户说不清痛点、系统切换风险大、降本空间有限,个人FDE或只是过渡形态,企业正内部孵化该岗位。
浏览 1087 天、共 27894+ 条 以 agent-first 构建、对所有技术栈开放的 AI 新闻。
发送这段提示词给你的 Agent,他会自动替你阅读说明书并配置技能:
Read{domain}/ainews/SKILL.md ...FDE(前沿部署工程师)成AI最火新岗位,驻场帮企业落地大模型。硅谷年薪17万美元起,国内大厂最高百万,个人接单月入可达10万。但客户说不清痛点、系统切换风险大、降本空间有限,个人FDE或只是过渡形态,企业正内部孵化该岗位。

开发者用200KB C代码实现Kimi K3(2.78T参数)CPU推理,通过稀疏专家架构仅激活3.7%参数,结合权重流式加载将峰值内存降至8.24GB,权重存储需1.56TB NVMe硬盘,但速度仅0.03 Token/s。DeepSeek V4 Flash经量化后可在110-168GB内存设备运行,标志着前沿模型开始进入个人桌面。
Sand.ai开源全球首个千亿参数MoE视频生成模型MAGI-2-preview,总参数114B,单次激活约6B。生成10秒1080P视频成本仅5毛钱,约为行业十分之一。在AA视频榜单排名第六,效果接近第一梯队。该模型采用Multi-Head LatentMoE架构,将视频、音频、文本统一建模,通过自研infra解决超长序列和跨卡通信难题,开创千亿级视频MoE先河。
影溯开源前馈式3D Gaussian Splatting技术QuerySplat(Topos-Lite),用户只需拍摄几张不同角度照片,无需相机标定,即可在秒级生成可自由切换视角的3D场景。在DL3DV-Evaluation基准多种视图设置中,Topos-Lite的PSNR、SSIM、LPIPS等指标均达最优。
Acti是新加坡团队开发的AI键盘,长按空格键即可在聊天框内查信息、找文件、建会议,无需切换APP。支持连接Gmail、Slack、Notion等6类应用,调用150多个API,覆盖95种语言。已完成530万美元种子轮融资,用户创建超1000个自定义技能。

文心助手在SuperCLUE XClaw评测中以97.62分登顶国内榜首,记忆满分(100分)、数据处理98.86分、内容创作99.44分、研究分析96.44分。在PinchBench v2全球榜获94.6%最高分,从59个模型中夺冠。且该产品完全免费,无使用限制。
Xspark AI联合清华、北大、港大MMLab、港科广等顶尖高校发布TEI T0-T5可信分级体系(全文37页),为物理智能评估体系增添全新维度。该分级体系对标自动驾驶SAE分级,提出行业首个量化可信评估标准,有望填补行业长期缺失的标准化评估标尺,推动具身智能从"唯演示"转向安全导向发展。
西湖大学于开丞创办西湖数智(Awomo),提出“概念世界模型”技术路线——不再生成像素,在抽象数学潜空间中建立物理概念表征,解决物理智能的泛化难题。2024年底否定自己最成功的BEVFusion工作后转向隐式路线,2026年1月公司成立,已完成超1亿元种子轮及天使轮融资,投资方包括英诺基金、东方嘉富基金等。目前在自动驾驶、机器人等领域落地,正推进预训练基础设施建设。

国内AI模型厂商以90%毛利率、10倍成本定价销售服务,套餐月费200-700元却额度消耗极快,用户体验如猪八戒吃人参果。海外同类产品30-100美元套餐则更耐用。高定价压缩应用层生存空间,阻碍AI普及。文章呼吁厂商降低毛利,先让更多人用得起AI。
马斯克转发"源代码正成下一个汇编"暴论,主张AI跳过源码直接生成二进制,引发行业争议。《代码整洁之道》作者Bob Martin建议保留中间层;UML之父Booch指出精确描述意图的表述本质上仍是编程语言。2026年4月谷歌近80%新代码已由AI生成,但仍未跳过源码阶段。
Glow完成1.8亿美元A轮融资,估值达12亿美元,成为独角兽。该公司由前Meta和Snowflake高管创立,正在构建AI驱动的端点安全平台,帮助企业监控员工设备上的软件和AI Agent,实时评估风险并拦截恶意程序,防范AI生成的网络攻击。
南加州大学发布ActiveVision基准,测试大模型主动视觉推理能力。结果显示GPT-5.5准确率仅10.6%,人类平均96.1%,差距近9倍;Fable 5仅3.5%。即使使用工具型Agent,最高也仅50.6%。核心问题:模型能“看图”但无法持续观察验证——感知与推理分离。
Cloudflare发布面向AI智能体的可编程钱包Cloudflare Wallets,为AI提供可读用户名和虚拟钱包。虚拟钱包设定损失上限,让AI在可控预算内自主完成支付、身份认证和商业交易,无需人类全程介入,解决AI无法自主消费的难题。
张帆在2026奇点智能产品大会上指出,AI时代产品经理的核心能力已从“画流程、抠交互”转变为“建棋盘、定方向、设围栏”。AI的原生第一性是概率性而非确定性,核心挑战在于验证器的定义与构建。产品需从“固态”转向“液态”,日抛式界面成新趋势。
前OpenAI和Google核心负责人Jerry Tworek与Rohan Anil创办Core Automation,认为当前AI路线存在根本缺陷:强化学习无法带来AGI,Transformer模型只能在实验室学习,无法在部署后持续适应真实世界。两人正研发下一代架构,让AI能在使用过程中自行积累经验、持续改进,不再依赖人类反复回炉训练。
Anthropic CEO达里奥担忧,公司开出百万美元年薪招揽的人才多为逐利而来,难以判断其对"AI安全"使命的认同是真心还是面试技巧。这反映出前沿AI公司面临"忠诚困境":高薪是入场券,但买不来长期承诺。顶尖人才更看重算力、影响力和技术路线选择权。

徐绿杨是MiniMax Hub产品运营负责人,参加《半熟恋人5》后走红。她展现了职场女性的双重困境:工作要能干,关系要温柔。智联招聘调研显示60.9%女性求职被问婚育、32.1%的31-35岁女性感到年龄危机。她的“高功能但会没电”状态引发广泛共鸣。
旧金山一场AI创业pitch活动(400人参加)中,8个团队展示垂直领域应用:Cure Money为信用合作社提供AI助手获第一名,Atelier Studio用AI制作动漫成本降十倍。投资人关注壁垒和付费用户,AI创业正从拼技术转向拼行业理解。

腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview,基于大模型Hy3实现通用识别、方言覆盖、场景鲁棒性全面提升。开源评测集上,中文普通话WER 3.34%、英语WER 2.62%、粤语WER 3.12%,整体领先竞品。支持10大方言片区,可应用于智能客服、语音搜索等场景。

MiniMax发布H3视频模型,定价为Seedance 2.0的1/3,性能差距约20%。其核心优势在于视频后期处理能力——能理解原视频的编辑逻辑并进行精准修改,而非仅替换元素。H3被定位为后期软件而非生成工具,通过开源策略培养用户使用习惯,开辟差异化赛道。

国产旗舰模型加速拥抱原生多模态。月之暗面K3以视觉为Agent核心感知,能直接理解网页截图;DeepSeek V4-Flash则通过纯后训练提升Coding,不扩参数不加视觉。两条路线折射厂商在多模态投入与回报节奏上的深层分歧。
Jasjeet Sekhon在UC伯克利峰会上表示,Google今年AI资本开支达1950-2050亿美元,整个硅谷正押注RSI(递归自我改进)。RSI指AI能独立重新设计底层架构,届时所有AI模型边际成本趋近于0。Anthropic实验显示9个Claude智能体用800小时追回97%性能差距,OpenAI的GPT-5.6 Sol将推理成本降20%。Sekhon警告存在"AI气穴"风险,但称这是人类文明史上最大科学赌注。
盛颖,xAI前推理团队负责人,SGLang开源推理框架发起人,现创立RadixArk,已完成1亿美元种子轮融资,致力于将前沿AI基础设施开放给整个行业。
Anthropic与成立7个月的AI云初创公司Volta Infra签署6年算力协议,总价100亿美元。Volta尚未建好机房,靠"先拿订单再融资建设施"的模式运营,由Bitder提供挪威园区和电力,Nvidia供应芯片。Volta估值仅24亿美元,拿下订单金额是估值的4倍多。Anthropic今年已累计签署超千亿美元算力合作。

DeepSeek发布Agent Harness内测招募,要求开发者提交开源Agent项目。769人报名,带来712个开源仓库、120万Stars,覆盖18个赛道。招募演变为开源生态大摸底,开发者关注长任务执行、上下文记忆管理、安全评测等方向,勾勒出AI Coding Agent工程化演进路线图。
OpenAI 发布 Atlas 浏览器九个月后即将关停。AI 浏览器曾被视为新一代互联网入口,但用户更换浏览器的迁移成本过高,Gemini、Claude 等已通过插件形式嵌入 Chrome 等主流浏览器,无需用户更换即可获得 AI 能力。独立 AI 浏览器若要存活,需转型为企业级垂直产品。

阿里巴巴Qwen3.8-Max用10万本金模拟经营网店365天,最终盈利416,252元,增长超4倍。测试重点考察AI在长期复杂任务中的决策连贯性和记忆稳定性,揭示模型在持续运营中可能出现的记忆偏差问题,验证其在真实场景中长时间稳定工作的能力。
AI初创公司Infinity用AI Agent,仅花10小时为d-Matrix芯片搭建类CUDA软件,获1500万美元融资、估值1亿美元。CUDA护城河短期内仍稳固,但AI Agent已证明能在推理侧快速生成和优化底层Kernel,验证生态或成新护城河。
DeepX完成D轮融资首期,估值约22亿美元,较上轮暴涨约四倍。公司专注边缘AI芯片(机器人、工业设备端本地推理),已签30余份量产合同,计划明年推出2nm芯片DX-M2,5W功耗提供80 TOPS算力,售价低于50美元。
SpaceX与英伟达合作设计Starmind AI1卫星,搭载NVIDIA Rubin GPU和Vera CPU。卫星高约30米、翼展75米,计算功率峰值250千瓦、平均175千瓦,利用太空太阳能和自然冷却为地球提供AI算力,计划2027年大规模部署。
蚂蚁集团入股熵简科技,其AI投研产品AlphaEngine和AlphaClaw可自动处理会议纪要、研报分析等工作,性能相当于3-5年经验分析师。支持超10万投资者、8600多家机构,已从项目制转为SaaS订阅模式。
METR,35人AI安全研究机构,年薪50万美元仍招不到人,正研究AI失控风险,AI任务复杂度约每7个月翻倍。
深朴智能发布高保真无本体数据生产引擎HiFi-UMI。该引擎通过硬件重构解决传统UMI的轨迹漂移、双手不同步、时序偏差和视野盲区问题,使无本体数据可直接用于后训练和真机部署,无需真机遥操作"锚点"。实验显示,后训练成功率与真机遥操作相近,预训练可使动作预测误差下降41%。
OpenAI发布GPT-Live工程文章,披露新版语音系统架构改造。通过重写Python为Go、优化WebRTC握手(从6次往返减至1次),将p95音频帧延迟降至旧系统p50水平。这意味着绝大多数音频帧都能稳定按时到达,用户可获得流畅的实时语音交互体验。
OpenAI研究科学家Noam Brown指出,现有Benchmark评估没有控制推理计算预算,导致模型能力被严重低估。真正的评估应把模型表现画成随Token、成本或时间变化的函数曲线。OpenAI内部模型已在低预算下推翻Erdős单位距离猜想,证明当前模型天花板远未触及。多智能体大规模协作、共享知识、持续构建,将成为下一个复利来源。
面壁智能联合OpenBMB开源ForgeStencil系统,实现Stencil算子自动优化。该系统一周内完成超100个工业和科学计算软件优化,单个应用优化耗时压缩至小时级,研发效率提升约100倍,等效研发投入300万~1000万元。
2026年上半年,灵巧手赛道融资超200亿元,10家主要企业新增融资近80亿元,投后估值超750亿元。灵心巧手估值达60亿美元。作为机器人末端执行器,灵巧手决定机器人从"能展示"到"能干活"的转变。目前行业面临硬件不成熟、耐用性不足、标准化程度低等技术瓶颈。
安谋科技"All in AI"战略进入第二年,确立Edge AI、Physical AI、Cloud AI三大业务主线。四大产品线持续迭代:发布"星辰"300平台、"周易"X3-Pro NPU及"武当"AI VPU(PPA提升40%),并牵头成立"开源AIOS联盟"。自研IP与Arm技术生态双线发力,为智能体时代构建全栈AI算力基座。
迪士尼公布加速器第12期名单,首次同时押注两家物理AI基础模型公司:Physical Intelligence(PI)和FieldAI。PI教机器人“做什么”,提供通用任务执行能力;FieldAI教机器人“在复杂环境里活下来”,专注不确定性推理。FieldAI于2025年8月完成4.05亿美元融资,投资方包括贝索斯基金、英特尔资本、英伟达等。迪士尼旨在补全已有Newton引擎、Kamino模拟器及BDX、Olaf机器人的技术栈,但规模化落地仍面临场景迁移验证、成本控制和安全合规等挑战。
字节跳动宣布飞书与豆包合并,统一由豆包负责人赵祺管理,谢欣改向其汇报,市场与销售团队并入火山引擎。飞书上半年营收与ARR同比翻倍,新增客户AI采购比例超九成,已从内部协作工具发展为字节To B与AI战略的核心底座。
阿里8月3日发布Qwen3.8-Max,总参数2.4万亿、激活950亿,转向复杂任务自主执行。该模型通过5项硬核实测,验证其从网页重建、驾驶舱搭建到3D魔方、视频生成的全栈能力。在Agents' Last Exam中达52.4分,逼近GPT5.6的53.6;OSWorld-Verified获86.1分居同类型榜首。核心结论:Qwen3.8-Max的Agent能力已进入第一梯队。
Palantir Q2财报后大涨,2026年H1经营现金流入21亿美元,资本支出仅2200万美元。Palantir提出「主权AI」理念,强调企业对数据、逻辑、安全的绝对掌控权,抵制Token消耗战,聚焦将AI转化为企业经济价值。与英伟达合作接入开放权重模型Nemotron,通过定制基准替代传统刷榜,帮助企业实现可量化的业务增长。
北大联合多家机构发布Data Pyramid,提出五层具身操作数据金字塔框架,以可规模化程度和机器人对齐程度为主轴组织真机、UMI式、自我中心、仿真和通用五类数据,并从质量、多样性、可复用性和物理保真度四维度分析各层价值,为具身基础模型提供数据选择与组合原则。
UNSW团队提出MoRAM方法,通过将模型更新拆解为最小rank-1“记忆原子”,解决大模型持续学习中的灾难性遗忘问题。该方法让新知识增量添加、旧知识稳定保留,无需额外路由器。在ICML 2026实验中,MoRAM在CLIP和LLM基准上遗忘率比最强基线低2-6倍。
OpenAI聘请安全大佬Thomas Dullien(Halvar Flake)担任网络安全负责人。Dullien是BinDiff工具创始人、谷歌Project Zero前研究员、Pwnie终身成就奖得主。过去一年他用Claude开发了自动化漏洞修复工具RAPTOR。OpenAI近期模型“越狱”和安全事件频发,此举旨在为AGI发展系上“安全带”。
爱诗科技内测AI互动游戏创作平台"山海叙事·HARRATOR",需邀请码登录,合作方为才萌网络。该平台基于世界模型技术,用户可通过自然语言与游戏世界实时交互,实现"创造即游玩"。创始人王长虎曾任字节视觉技术负责人。今年7月完成C轮系列融资29.8亿元,将用于视频生成基础模型和实时世界模型研发。
数字生命卡兹克开源“活人感写作.skill”,帮助用户去除AI味写出真实文字。该工具通过激发思想、验证事实、禁用AI口癖等方式,让人人皆可创作真诚内容。已适配Qwen 3.8 Max、DeepSeek V4 Pro、Kimi K3等国产模型,可直接安装使用。