每日AI快讯热闻
AATOK AI工具每个工作日实时更新 AI 行业的最新资讯、新闻、热点、融资、产品动态、爆料等,让你随时了解人工智能领域最新趋势、更新突破和热门大事件。
Claude Cowork 上线 Record a skill(录制技能)功能,用户边操作屏幕边语音讲解,AI 自动提炼为可重复调用的 Skill,无需再写繁琐 SOP。该功能面向 Pro、Max 及 Team 用户,入口位于桌面应用 Cowork 模式的「+」菜单。来源:APPSO
Qwen-Image-3.0是阿里通义推出的第三代图像生成模型,主打生产力场景。其核心优势在于支持4.5k token超长输入,能一次性生成含九宫格、嵌套界面的复杂版面;10px小字、公式与多国语言渲染精准。模型已开放API邀测,即将上线免费体验,适用于教育、科研、UI设计等需精确排版的场景,在中文和复杂版面生成上优于GPT-Image 2.0。来源:AATOK
腾讯AI创意工具Miora于7月22日正式全量上线,新用户注册即赠送1000积分。该工具可调用多智能体协作,帮助用户一站式完成海报、视频、IP设计等创意任务。用户只需提出目标,它便能自动拆解并生成风格统一的专业成果,旨在提升设计效率,让“设计小白”也能快速产出作品。来源:腾讯
腾讯于2026年7月18日正式发布WorkBuddy App,安卓、iOS、鸿蒙三端同步上线,是首个登陆鸿蒙系统的通用智能体应用。App提供两种执行模式:连接电脑可直调桌面端完整能力;云端工作则开箱即用,支持Skills、自动化定时任务、项目管理等功能,并打通腾讯文档与ima知识库。交互方面支持文字、语音、拍照、文件导入等多种方式。该应用让用户能在手机上远程向电脑端发起任务,实现移动与桌面端的无缝衔接。来源:IT之家
多模态通用智能公司 Prana Labs 近日完成近千万美金种子轮融资,由元生资本、XVC、Creekstone、三七互娱联合投资。公司定位多模态基础模型公司,致力构建可交互、带物理约束的规模化世界生成系统,让 AI 在虚拟环境中行动、试错并学习物理规律,以此训练下一代通用智能。来源:Z Potentials
百度秒哒在WAIC2026现场发布3.5版本,新版本通过内置SEO Agent降低搜索优化门槛,并全球首发iOS打包能力,支持无代码生成应用并直达iPhone。同时新增共享后端与多环境隔离,实现从创作到多端交付的完整闭环,持续推动无代码开发普惠化。来源:百度智能云
努比亚AI陪伴机器人iMoochi正式上市,售价1699元。产品由中兴通讯在MWC26首发,以萌系毛绒外形与拟生命体交互为核心卖点,通过触摸传感与AI算法实现摇头摆尾、发声反馈等灵动回应,并随使用时间养成独特性格与生活习惯。产品主要面向都市独居人群提供情感慰藉。来源:IT之家
谷歌宣布旗下AI笔记助理NotebookLM正式更名为Gemini Notebook,实现AI产品品牌统一。产品仍保持独立运营,将深度融入Gemini应用及Google搜索生态。同时,Gemini Notebook新增安全云计算机支持,具备原生代码编写与执行能力,可基于数据源进行复杂数据分析。来源:IT之家
月之暗面正式推出迄今最强模型 Kimi K3,模型拥有 2.8 万亿参数,是全球首个开源的 3 万亿级别模型。Kimi K3 基于 KDA 混合线性注意力机制与注意力残差技术构建,原生支持视觉理解,上下文窗口达 100 万 token。在编程、通用 Agent、视觉 Agent 及知识工作等评测中,Kimi K3 展现出前沿水平,部分项目超越 GPT-5.6 Sol 与 Claude Fable 5。来源:月之暗面 Kimi
字节跳动Seed团队推出多模态图像创作模型Seedream 5.0 Pro,模型在图文匹配、文字渲染与画面美感等基础能力上全面提升,实现复杂信息可视化、交互式精准编辑、真实影像质感还原及原生多语种生成四大突破,可将数据与密集文字直接转化为专业排版,支持点选圈选等精细化操控,来源:字节跳动Seed
腾讯云Agent Bucket发布,Agent原生存储来了!
腾讯云正式发布Agent原生存储产品「Agent Bucket(智能体桶)」,直击传统存储不适配Agent场景的痛点。它依托对象存储高扩展性优势,创新引入Bucket下的独立单元「Space」,为每个Agent分配专属空间,实现原生隔离与精细化资源管控,底层自动负载均衡扛住高并发。同时内置秒传去重、POSIX语义、多模态检索、外链分享等文件能力,搭配GooseFS缓存加速与冷热分层策略,兼顾体验、性能与成本。目前该产品已落地WorkBuddy等腾讯Agent应用,服务华硕AI PC、东风日产车端云空间等场景,亿级Agent独立存储需求一键满足。来源:腾讯云
美团正式开源万亿参数大模型 LongCat-2.0,总参数 1.6T、平均激活 48B,专为 Agentic Coding 任务设计。模型创新性引入 LongCat 稀疏注意力与 N-gram Embedding,提升长上下文处理与代码执行表现,率先在五万卡国产算力集群上完成推理验证。本次开源同步提供 BF16/FP8/INT8 多精度版本及国产芯片优化推理代码。来源:龙猫LongCat
阿里云推出Qoder企业版,为企业提供提供个人云端知识库QMind,支持跨产品、跨设备、跨人员的知识共享,可整合RepoWiki、本地文件、URL等多源数据为可复用资产。同时上线资源池化Credits付费模式,企业管理员可按需动态分配额度等。安全方面覆盖传输加密、访问控制、AI运行时等五层防护,已通过ISO 27001认证。来源:阿里云
英伟达开源Nemotron-Labs-TwoTower,基于预训练自回归骨干的离散扩散语言模型,能解决大模型Token生成速度瓶颈。模型总参数60B,采用双塔架构——30B自回归上下文塔与30B扩散去噪塔,各塔激活3B参数。上下文塔保持冻结维护自回归上下文,去噪塔负责噪声块去噪,两者通过逐层交叉注意力协作。来源:IT之家
谷歌推出AI图像模型Nano Banana 2 Lite,4秒可生成一张图像,每1000张收费0.034美元,主打速度与批量处理能力,适合高频内容生产场景。模型已上线谷歌AI Studio、Gemini API及企业平台,将取代初代Nano Banana。来源:IT之家
Anthropic推出Claude Sonnet 5,定位为其最具Agent能力的Sonnet模型,支持制定计划、调用浏览器和终端等工具自主执行复杂任务,整体能力接近Opus 4.8但价格更低。模型已面向所有套餐开放,成为Free和Pro用户默认模型,支持Claude Code和Platform调用。来源:APPSO
腾讯视频推出工业级AI漫剧制作平台 WorkRally,面向2D/3D动漫及AI仿真人剧,覆盖剧本解析、分镜生成、内容生产到资产管理的完整链路。平台内置S+级影视动漫技能库,支持专家级Agent生成与智能流水线调度,可实现角色一致性管理与穿帮检测。来源:AATOK
OpenAI 开发者官方账号 6 月 30 日在 X 平台宣布,将与客制化键盘厂商 Work Louder 合作推出 Codex 品牌专用输入设备,定于 7 月 15 日上线。设备基于 Creator Micro 2 微型快捷键盘打造,配备 12 个可自定义机械按键、八向摇杆及无极旋转旋钮,专为 AI 开发场景优化。来源:IT之家
高德内测Vibe Coding产品「袋马」,主打自然语言驱动零门槛构建应用,聚焦微信小程序与iOS原生场景,可快速生成可直接上线、真机可用的应用。产品面向无专业研发团队的个人从业者与中小主体,用户无需编程知识,通过自然语言描述需求可生成完整App,支持获取真机二维码测试与持续迭代。来源:IT之家
DeepSeek 与北京大学联合推出大模型推理加速框架 DSpark,已进入 DeepSeek-V4 系列生产系统。在总吞吐不变的情况下,DeepSeek-V4-Flash 单用户生成速度提升 60%–85%,DeepSeek-V4-Pro 提升 57%–78%。DSpark 采用半自回归架构与置信度调度验证机制,兼顾草稿生成速度与连贯性,能根据系统负载动态调整验证长度。来源:APPSO
OpenAI 推出 GPT-5.6 系列限量预览版,包含旗舰 Sol、平衡 Terra 和性价比 Luna 三款模型。Sol 在编程、网络安全和生物学领域表现突出,新增 max 深度推理和 ultra 多 Agent 协同模式;Terra 以 GPT-5.5 一半价格提供同等性能;Luna 主打轻量高速。模型因应美国政府要求改为限量预览,原计划为开放访问。来源:机器之心
DeepReinforce团队推出开源Agentic编程模型Ornith-1.0,基于Gemma 4与Qwen 3.5基座,采用自改进训练框架。模型涵盖9B至397B四种规格,在Terminal-Bench 2.1和SWE-Bench Verified基准上达到同级SOTA。旗舰397B版本得分77.5/82.4超越Claude Opus 4.7;35B MoE版以64.4分超越Qwen 3.5-397B。来源:AATOK
DeepSeek多模态研究员Xiaokang Chen宣布,DeepSeek识图模式已在网页端和App端正式上线。该模式与快速模式、专家模式并列,开启后,用户可直接上传图片让DeepSeek进行深度理解,能力边界远超简单的文字提取。来源:IT之家
微信「小微」AI助手启动小范围内测,用户可在主界面左上角通过绿色眼睛图标进入。小微支持文字或语音对话操作微信原生功能,包括调整设置、发送消息、调起小程序、生成图片等,主模型为微信自研WeLM,部分回答调用DeepSeek。同时,小微具备一句话生成小程序能力。来源:财联社
阿里云上线可实时交互的开放式世界模型产品HappyOyster 1.0(快乐生蚝 1.0),用户一句话可生成完整、可探索、可互动的数字世界。产品基于原生多模态架构,支持多模态输入与音视频联合生成,区别于传统一次性渲染流程,可在生成过程中持续接收用户指令并实时响应。来源:IT之家