深涌智能开源DojoAgents项目,上线一周获1000+ GitHub Star。该框架将市场扫描、新闻检索、公司分析、产业链映射、组合构建和风险分析拆解为可调用工具,通过Agent Loop实现持续主动的研究与决策辅助,帮助投资者在复杂市场中快速梳理信息、验证判断、生成可追踪的模拟组合。
浏览 1142 天、共 29692+ 条 以 agent-first 构建、对所有技术栈开放的 AI 新闻。
发送这段提示词给你的 Agent,他会自动替你阅读说明书并配置技能:
Read{domain}/ainews/SKILL.md ...深涌智能开源DojoAgents项目,上线一周获1000+ GitHub Star。该框架将市场扫描、新闻检索、公司分析、产业链映射、组合构建和风险分析拆解为可调用工具,通过Agent Loop实现持续主动的研究与决策辅助,帮助投资者在复杂市场中快速梳理信息、验证判断、生成可追踪的模拟组合。
Acrab在2026 WAIC发布Agent Box个人AI中心,基于GΞLIX 1平台可本地运行千亿参数模型,集成8MB L1 Cache与650 TOPS算力。该设备实现Agent上下文保存、工具调用与多Agent协作,消除云端Token成本。CEO Ken Phua为前Arm China联席CEO,公司累计融资超3.5亿美元,定位为Agentic AI时代的计算底座。
腾讯混元多模态理解负责人胡瀚提出离职创业,原团队或聚焦世界模型。田永龙接替负责VLM研发。姚顺雨上任后推动资源聚焦大语言模型,7月推出大模型Hy3。腾讯2025年资本开支792亿元,面临阿里(1260亿元)、字节(700亿美元)的竞争压力。

Kimi暂停新订阅后,用户可通过API调用K3。测试显示:API直连交付最快但无过程反馈;接入Claude Code可获得文件读写和工具调用能力,但存在首次未成功落盘、视觉风格漂移等问题;官方客户端表现更细致。核心发现:同一模型进入不同harness(外壳)后,能力、行为和产品表现都会改变。API迁移出的是模型推理能力,但不会附带系统提示、工具编排等配套服务,稳定性需用户自行承担。
元川微完成Pre-A轮数亿元融资,由IDG资本领投。公司由华为背景团队创立,专注Agent时代推理芯片,核心技术包括时空编译器、硬流水架构和大带宽存储。LPU架构专为多模态和MoE模型优化,可灵活覆盖云边端场景,支持极低延迟推理。2026年已完成四轮融资,公司成立于2025年9月。
设序科技完成B轮超亿元融资,累计融资超3亿元。其“则形AI”平台整合几何AI、物理AI、制造AI三大模块,为工程师提供设计辅助。上半年合同额同比增长70%,全年预计近2亿元。公司将今年定为出海元年,首站德国,下半年目标落地10个客户。
GPT-5.6 Pro推翻近30年Dinitz-Garg-Goemans猜想。研究者Rybin仅用4条提示词(58个英文单词)引导AI穷举验证,构造出仅7节点、9边的反例图:不可分流方案最低成本60,猜想预期58,二者不可兼得。
灵初智能与北大-灵初联合实验室发布开源双灵巧手通用操作大模型EgoSteer及全栈系统,含数据管线EgoSmith(处理9.6K小时人眼视频)、世界模型增强VLA及Robot-Stack机器人系统。该模型在40个任务上达75%成功率,少量示范即可泛化新任务。公司成立一年半已完成20亿元融资。
研究人员利用GPT-5.6 Sol在OpenFPM平台上,通过Clang/HIP、SPIR-V、Vulkan和MoltenVK等中间层,成功让CUDA程序在苹果M3 Pro的Metal GPU上直接运行。同一程序相比CPU顺序计算获得约10倍速度提升,验证了跨平台GPU计算的可行性。
优艾智合FabriVLA在Meta-World MT50测试中以90%成功率登顶具身智能榜单,超越π0等国际模型。该1B参数模型通过门控自注意力与深浅层视觉融合两项架构创新实现SOTA,验证轻量化模型具备顶级具身智能操作能力,为边缘部署奠定基础。配套FabriX大模型与隙锋人形机器人已获4000台订单。优艾智合深耕工业9年,完成800+真实场景交付。
梅西于2022年在旧金山创立风投公司Play Time,首期基金约2亿美元。投资版图曝光,包括李飞飞的World Labs(估值50亿美元)及AI数据平台SuperAnnotate、机器人Field AI等,覆盖AI底层工具和实体机器人赛道,打破体育明星只投地产餐饮的印象。
英灵殿创始人Odin(00后),高中辍学自学考入浙大,曾加入诺奖得主David Baker实验室并离开创业。已获五源资本、奇绩、真格等数千万元融资,团队30人。目标是打造全模态分子世界模型,把人类科学发现效率提升百倍,让罕见病患者有药可医。
Anthropic在CMA平台推出六项更新:技能上限从20大幅提升至500,支持一个会话运行完整业务单元;思考力度新增五档可调,复杂问题深度推理,简单问题节省token;种子会话一步创建(带50条初始事件);子agent实时流下探到线程级;7种新webhook覆盖环境与记忆存储全生命周期;版本字段变可选。Anthropic正将agent打造为操作系统级别的基础能力。
科大讯飞成立爻方智能(注册资本3亿元),潘嘉带队发布技术报告iFLYTEK-Embodied-Omni,指出当前机器人大脑主流路线缺乏“本体认知”,提出双核架构(VLM+VGM+AGM协同),以逆运动学训练让机器人“认识自己”。测评显示零样本泛化成功率89.6%,双臂协同超93%,意在破解机器人“困在Demo”难题。
影眸科技论文《cuNRTO》入围RSS 2026最佳论文提名。该工作将非线性鲁棒轨迹优化GPU加速,在独轮车、四旋翼和机械臂任务中实现最高139.6倍加速,同时保持100%安全约束,解决了仿真到现实的部署难题。

研究表明,使用AI后人们说“我不知道”的比例从44%骤降至3%,正确率从27%跌至9%,但自信心从30%飙升至76%。即使答错要罚钱,人们仍难以摆脱对AI错误建议的依赖。AI流畅的幻觉答案会侵蚀人类区分真知与合理猜测的元认知能力,且儿童风险更高。

DeepSeek完成首轮外部融资超500亿元,投前估值约3675亿元。创始人梁文锋在近4小时的投资者交流会上,系统阐述公司愿景、AGI路线图、开源策略等。他表示开源将成竞争优势,国产算力生态一年内可建立,Coding Agent是现阶段最重要方向。
国防科大团队推出AirZoo——面向航拍几何3D视觉的统一大规模数据集与评测基准,覆盖全球22个国家、超120万帧RGB-D数据及6-DoF位姿标注。基于AirSim-Cesium-Unreal仿真管线构建,支持航拍图像检索、跨视角匹配与多视图3D重建三大任务。实验表明,微调后主流模型在定位、匹配、重建任务上性能显著提升,已被ECCV 2026接收。
美团发布LongCat-2.0万亿参数模型,成为业界首个在5万卡国产算力集群上完成训练的万亿参数大模型,并同步推出LongCat顶尖人才校招计划,以行业领先薪酬和TOP人均算力争夺AI顶尖人才。
北京邮电大学、清华大学、上海交通大学合作发布MemSlides,登顶Hugging Face日榜,GitHub获400+ stars。该系统通过用户画像记忆、工作记忆和工具记忆让AI记住用户改稿习惯,实现首轮生成即贴合用户偏好,多轮修改时只改局部而不打散整套风格,解决AI PPT"牵一发动全身"的核心痛点。

昆仑万维在WAIC 2026期间发布世界模型Matrix-Game 3.5,能根据用户动作和事件指令持续生成可交互世界,在长时序中保持场景结构和角色身份一致性。模型通过采样步数压缩、DiT推理优化和VAE加速,在单张GPU上实现720P分辨率约20FPS实时流式视频生成。3.5版本引入业内首个几何对齐Patch Memory长期记忆机制,支持多风格切换、NPC交互和真实场景扩展。Matrix-Game坚持开源,英伟达、Adobe等大厂已将其作为对比基准。
创作者阿真开发"风格包Skill"工具,可自动收集整理电影截图,生成色卡、风格规则和提示词模板。该工具按场景分类截图,每张色卡固定10个色位,支持Codex和Work Buddy安装。它能解决AI生成内容时风格不统一的问题,将模糊描述转化为可复用的视觉规范。
Instagram掌门人Mosseri透露,公司正将传统13人产品团队精简为6-7人的Pod,包含4-6名通才工程师和1名产品参谋。AI工具承担代码执行后,工程师工作重心从编码转向规划和审查。专家角色从固定配置转为按需调用。他指出AI时代人的价值在于品味与战略判断,能清晰定义目标、发现方向错误的人将更有效率。
北京市发布《加快智能体引领发展的若干措施》,包含10条政策,涵盖基础模型能力、驾驭层工程、原生应用、智能终端融合、OPC创业、Token经济、安全治理、算力保障、开源开放等内容,旨在构建AI时代智能经济新形态,推动智能体技术普及应用。
智象未来完成15亿元C轮融资,近三月累计融资超21亿元,投后估值突破10亿美元跻身独角兽。公司由加拿大工程院院士梅涛创立,专注原生全模态世界模型技术路线,HiDream-O1-Image登顶全球文生图榜单。股东阵容汇聚社保基金、国资、产业资本及市场化机构20余家,并已完成股改。
AI公司Video Rebirth发布世界模型Olympus,采用视频原生路径,将视频作为理解和生成世界的基础载体。模型具备实时可交互、物理一致性、声画同步、长程记忆等核心能力,基于自研BACH视频生成引擎训练,可支撑游戏智能体、机器人、自动驾驶等物理AI应用,已在AMD MI350上完成部署。
前豆包PC端负责人齐俊元推出AI创业项目"Today AI",定位为拥有自主思考能力的操作系统,让AI能看懂界面、操作手机并直接执行任务,而非仅被动回答问题。该项目至少三个月前启动,已获IDG等机构数亿美元融资,目前开放Mac、iOS、安卓内测。

马斯克宣布Grok Imagine将于年底前制作完整AI电影版《奥德赛》,直接挑战诺兰真人版(首周末全球票房2.64亿美元)。一段3分钟AI短片的惊艳效果成为推手,展现个人创作者借助AI生成电影级画面的可能。有评论指出,这标志着电影制作正从资本密集型转向想象力密集型。
淘天集团发布if Studio智能体工作台,将设计专家做成流水线式创作工具。用户只需描述需求,系统自动拆解任务并调用模型完成设计,支持海报、视频、落地页等多种场景。实测生图可直出、改稿4轮不到8分钟、商品视频生成不到20分钟,对比外包节省1-3天周期和数千元成本。该产品实现了从“抽卡式”到“流水线式”的设计模式转变,让创意输出更可控。
7个AI模型挑战IMO 2026全部6道题,Claude Fable 5、GPT-5.6 Sol、Kimi K3、AxiomProver四方满分夺冠。人类选手7年4347人中仅30人满分(0.69%)。这些AI无需专项数学训练即达满分,意味着AI已具备超强逻辑推理能力,未来可帮助普通人完成合同审查、税务规划等需严密推理的工作。

百度秒哒3.5版本在WAIC 2026发布,累计服务超3500万用户,日活近20万。新版本推出SEO Agent、iOS打包、共享后端等六大功能,简化应用开发流程。实测发现:共享后端功能流畅可用,SEO Agent操作便捷但优化有限,iOS打包测试中页面白屏崩溃,PRO会员也无法解决。评测认为产品方向正确,但平台稳定性决定用户体验,3500万用户中真正留存的数量存疑。
高德发布全栈具身技术体系ABot,发布5款新模型(N1、M0.5、ER、AgentOS、C0),在17项权威基准取得SOTA。采用三层架构通过数据回流实现闭环自进化。N1导航成功率92.9%,M0.5复杂任务领先前代20.4%,依托二十年时空数据积累构建完整闭环,让机器人从能动走向能干活。
超维动力在WAIC 2026发布全球最高自由度人形机器人KAIBot(115个自由度),身高173cm、体重70kg,全身18,000个触点实现0.1牛顿精度感知,搭载37个自由度灵巧手和KAI世界模型算法,能自主打乒乓球、实时对话、打开易拉罐。
中山大学、鹏城实验室与X-Era Lab联合发布PhyAgentOS并全面开源,这是专为物理智能模型和异构机器人打造的开源运行底座。它以Session为核心实现任务统一调度,让AI从"会思考"走向"可靠执行"。实测显示,该系统使LIBERO基准成功率提升至97-99%,CALVIN长时序任务提升至45-89%,《饥荒》存活天数从1.02天提升至2.10天。
梅卡曼德在WAIC展示「一脑多形」具身智能方案,以「眼脑手」体系让不同机器人共用同一大脑。3D视觉感知环境,Mech-GPT大模型理解推理,灵巧手执行动作,形成感知—决策—规划—执行—反馈闭环。产品已在全球落地27000+套,服务100+家财富500强客户,覆盖汽车制造、物流、新能源等行业的精密装配与柔性操作。
Sekai是一款AI应用生成平台,用户输入一句话即可生成可玩的小程序。目前平台累计创建超1500万个mini-app,每日新增超20万个。已完成2600万美元融资。Sekai将App创作门槛大幅降低,让任何人都能快速制作并分享互动内容,类似TikTok的内容生产逻辑。
清华大学AIR助理教授赵昊提出“原生4D世界模型”,指出真正面向自动驾驶和机器人的世界模型需整合几何、时间、光学与力学属性。他强调4D表征比视频生成更可解释、可修正,团队已发布Dexora(ICRA 2026 Best Paper)、Trellis.2(CVPR 2026最佳学生论文)、OmniNWM等系列成果。
SSNA团队提出噪声自适应框架NAF,利用随机高斯噪声构造判别性类别结构并迁移到真实数据,在每类仅4个标注样本下,基于ResNet-18在CIFAR-10上较ERM基线提升12.35个百分点,论文已发表于ICML 2026并开源。
金山办公发布独立AI办公Agent灵犀专业版,定位为"每个人的办公助理"。实测可整理10万字速记生成知识库,约10分钟生成8页PPT并支持多轮修改,Excel数据联动修改后自动更新指标。核心特点为"懂你":通过记忆功能理解用户工作历史,区分已确认要求与临时尝试。金山的战略意图是"重做WPS",从处理单个文件升级为处理整项工作,同时保证交付物可修改追溯。
2026 WAIC聚焦四张世界模型榜单:VBench评价"像不像"、WorldModelBench评价"懂不懂"、RoboTwin 2.0评价"动不动"、Physics-IQ评价"准不准"。Magi-1在Physics-IQ以56%登顶榜首,Sora 2仅42%。评测体系建立让行业从模糊叙事走向有清晰边界。
科大讯飞AI大学堂在WAIC 2026上升级,定位从"学AI"转向"用AI学",发布AI Learning(智能规划学习路径)和AI Vault(个人知识管理)两大功能。嘉宾认为AI时代知识廉价,经验、判断力、执行力更珍贵,建议建立知识坐标系、做AI native、快速行动。
超聚变在WAIC 2026发布FusionOne AI,推出桌面级TokenBox™与专属Token Factory解决方案,将算力稳定转化为有效Token。国内日Token调用量两年翻千倍至140万亿,AI Coding占全球消耗超50%。超聚变自研AI Coding三个月交付50万行代码,验证Token工厂可行性。
它石智航在WAIC 2026发布具身原生基座模型AWE 3.5。该模型基于超百万小时human-centric数据训练,是具身智能领域首个打通预训练到后训练完整范式的原生模型,采用One Model架构可同时输出动作和预测未来,实现具身Scaling全面释放。
浙江大学联合NVIDIA发布Light Interaction方法,无需重训练即可让视频世界模型推理提速最高2.59倍。方法通过感知交互状态动态管理上下文、回访时复用去噪缓存、软硬件协同3D稀疏注意力实现加速。在HY-WorldPlay上延迟从228秒降至88秒,峰值显存从76GB降至55GB。
智谱首席科学家唐杰预告GLM将迎"史诗级Plus"升级。其团队与清华的IndexCache论文已被COLM接收,该技术通过跨层索引复用优化长上下文推理,最多削减75%索引计算,200K上下文首Token速度提升1.82倍。智谱还落地1GW国产算力中心并收购中科加禾,完善从芯片到模型的完整链路。
星源智推出DA-Nav方向感知视觉语言导航框架,将导航指令、空间理解与偏航恢复统一到决策链路中。该系统具备98.15%的纠偏成功率,使机器人能主动修正偏离并恢复正确路线。相比去除恢复数据后骤降至15.46%的成功率,验证了“错误状态纳入训练”的必要性,系统完成超1200米跨本体迁移验证。

南京大学等团队发布VideoChat3,4B参数视频理解多模态大模型。该模型采用I3D-ViT视觉编码器实现16倍时空压缩,通过自适应帧分辨率机制处理流式视频,在长视频推理中显著降低视觉token和计算成本。在Video-MME上获70.1分,19项指标中18项超越Qwen3-VL-4B。数据、代码、模型权重全栈开源。
苏度科技在WAIC 2026首次国内亮相,展示Sim-to-Real技术路径机器人。其核心路径为软硬件协同+上下分层架构:上层任务规划,下层物体操作。R1机器人零样本通用抓取单次成功率达98%。创始人苏昊为ImageNet核心作者,将2D数据集思路迁移至3D领域解决机器人数据稀缺问题。CEO韩铮预测下半年硅谷将重新回到分层架构方向。
OpenAI计划在佐治亚州投资超300亿美元建设数据中心,锁定3.2GW电力供应,预计2028年投用。OpenAI承诺在该县投资200亿美元,并寻求合作伙伴共同融资开发。作为Stargate计划一部分,此举旨在支撑AI长期发展目标。
黄仁勋接受Axios专访力挺中国开源模型,称美国公司应被允许使用优秀开源模型,免费AI利好芯片和数据中心。马斯克转发支持。白宫指控Kimi K3蒸馏Claude,209家创业公司联名反对封禁中国开源模型。