每日 AI 快讯

第 1 / 1 页

页面展示最近 10 天窗口内已同步的 AI 快讯,计划任务会自动刷新并清理超出窗口的旧数据。

最近同步时间:2026.08.18 19:27
8月18·周二
Cursor 推出 AI 原生代码托管平台

Cursor推出AI原生代码托管平台,即日起向所有付费用户逐步开放Beta版。平台提供代码仓库、PR审查、代码浏览及GitHub双向同步等核心功能,支持与GitHub仓库并存运行。平台已集成Vercel、Depot、Buildkite等第三方应用,每个仓库内置AI智能体可直接修改代码、更新PR。

智象未来推出交互式世界模型 HiDream-O1-World

智象未来推出原生全模态交互式世界模型,支持文本、图像及交互多模态输入,具备漫游、编辑、交互三大功能。模型搭载自研UiT架构,在时空一致性与物理一致性上实现关键突破,首次参评即登顶WBench交互式世界模型评测Navi分榜。应用场景涵盖AI互动影游、具身智能仿真及3D场景生产等领域。

昆仑万维推出 AI 音乐生成模型 Mureka V9.5

昆仑万维推出AI音乐生成模型 ,基于 MusiCoT框架,V9.5 在编配留白、人声真实感与意图精准度上大幅跃升,人声良品率达 61.0%,控制良品率达 97.0%。模型在中文国风领域实现突破,咬字更准、和声更克制、编曲更具神韵。Mureka V9.5基于超 2.5 万份 用户反馈迭代,能让AI音乐从能生成走向值得单曲循环。

阿里千问办公开源上下文基础设施项目 MyContext

阿里千问办公开源上下文基础设施项目 。项目以本地化方式运行,将钉钉、飞书等IM沟通、文档、会议等多源工作数据自动沉淀为Agent可理解的专属工作档案,信息可溯源。针对信息冲突采用语义分析或用户确认机制,确保准确性。用户可据此构建专属Agent助手,自动回复工作信息。

AI视频生成独角兽 Higgsfield 完成4亿美元融资

AI视频独角兽完成4亿美元融资,投后估值54亿美元(约366亿元),投资方包括DST Global、高盛、Liberty Global和英特尔。公司年化营收达7亿美元,一年内增长约34倍,估值8个月涨315%。平台拥有超3000万用户,覆盖238个国家和地区。

8月17·周一
Stripe以超过70亿美元价格收购 OpenRouter

支付巨头Stripe已敲定收购AI基础设施初创公司,交易金额超70亿美元(约473亿元人民币)。OpenRouter为用户提供统一入口,可在超400种AI模型间按需选择,全球用户达800万。公司今年5月B轮融资估值约13亿美元,此次收购价为其5倍以上,将成为近年AI基础设施领域重大收购案之一。

阿里巴巴推出 AI 音乐模型 HappyShrimp

阿里巴巴推出AI音乐模型(快乐虾米),支持端到端整曲生成,实现作词、作曲、编曲、演唱一体成型。模型深度理解自然语言,用户仅需描述情绪或故事即可创作,大幅降低音乐创作门槛,同时解决AI音乐人声机械、词曲错位等痛点。

Qwen-Audio-3.0系列语音模型正式上线千问AI平台

阿里巴巴Qwen-Audio-3.0系列语音模型正式上线千问AI平台,开发者可通过API或Token Plan调用。Qwen-Audio-3.0系列包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型、实时语音交互对话模型。目前已在、等产品中落地应用。

SpaceXAI以600亿美元正式完成收购 Cursor

SpaceX以600亿美元正式收购,团队将加入SpaceXAI共同开发系列及Cursor产品。这是史上最大规模的创业公司收购案。将借助SpaceX全球最大GPU集群获得更强算力,同时xAI发布全新AI队友产品,可24/7自主运行多步骤真实任务。

8月14·周五
谷歌推出最新主力模型 Gemini 3.7 Flash

谷歌推出模型,专为编程与Agents场景设计。模型在软件工程、知识工作及网页开发等方面大幅提升。即日起至2026年底,首发优惠价仅为3.6 Flash原价的一半:输入每百万Token 0.75美元,输出3.75美元。已接入该模型,优化Workspace工具使用能力。

智谱推出最新 AI 大模型 GLM-5.3

智谱推出,基座未变但通过后训练Scaling大幅提升智能上界,成为当前编程能力最强的开源模型,在Terminal Bench 3.0等多项基准测试中取得开源第一。模型同时涌现出强大的网络安全能力,在代码审查与漏洞发现等任务中表现突出。智谱联合多家安全团队累计发现2436个漏洞,并启动”开源的盾”计划。

MiniMax 开源音乐模型 MiniMax-Music3

MiniMax 开源音乐模型,支持歌词生成最长 5 分钟歌曲。模型采用分层架构:8B 全局模型负责长程语义与结构,0.6B 局部模型恢复细粒度声学信息。MiniMax-Music3输出 32kHz 立体声 WAV,可保持主题、节奏、歌声身份及编曲推进,覆盖前奏、主歌、副歌等结构。

小红书开源多模态 MoE 模型 dots3-note preview

小红书 dots 模型实验室开源 ,为 dots3 系列首个开源版本。模型总参数 280B、激活参数 16B,支持 512K 超长上下文,具备文本、视觉与语音多模态理解能力,针对复杂推理、Agent 和多模态感知优化。模型在多项 benchmark 上可比肩参数数倍的大模型。

8月13·周四
DeepSeek-V4-Pro 正式版上线

DeepSeek 推出 正式版,已同步在、和API上线。该版本Agent能力显著增强,在Terminal Bench、DeepSWE等评测集上表现优异。API新增原生支持OpenAI Responses API格式,适配;思考模式新增low/high/max三档可选。

DeepSeek Harness 开发者预览版开放测试

开发者预览版(v0.1 版本)面向全球 Harness 开发者开放测试,并同步以MIT协议开源。产品采用”一切皆插件”架构,基于Cordis插件系统构建,模型、工具、技能等Agent能力均可自由替换组合。提供标准、PTC、极简、创造四种运行模式,支持完整工具调用与自定义预设。

SpaceXAI 推出 AI Agent 系统 Grok Bot

SpaceXAI 推出 AI Agent 产品,可登录用户账号在云端独立运行,24 小时不间断执行任务。每个 Bot 拥有专属云计算机,支持多 Bot 并行协作、Bot 间通信,可自主创建新 Bot。Grok Bot 产品原型为 xAI 收购 Cursor 前其内部代号「Sand」的 Agent 项目。

SpaceXAI 推出最新一代旗舰大模型 Grok 4.6

SpaceXAI正式推出模型,进一步强化长时间智能体任务、复杂交互及视觉工作能力,可处理资料研究、代码库分析等复杂任务。在AA Intelligence Index综合基准测试中,Grok 4.6与GPT-5.6 Sol取得相同成绩。

小红书开源语音合成基座模型 dots.tts

小红书 dots 团队与上海交通大学 X-LANCE 实验室联合开源,一款 20 亿参数、全连续隐空间自回归 TTS 基座模型。模型不依赖离散声学 Token,在零样本声音克隆评测 Seed-TTS-Eval 上达到 SOTA,支持音色微调与语音编辑。

记忆功能上线,让 Meoo 越用越懂你

上线记忆功能,支持自动整理并保存用户的个人背景、工作习惯、回应风格及项目规则等长期有效信息,在后续对话中智能调用。记忆分为仅本人可见的”个性化记忆”,含用户画像、工作手册、回应风格、记忆碎片和团队共享的应用记忆两类。

LTX 开源 AI 视频生成基础模型 LTX-2.5

开放世界模型公司 LTX 发布,原生集成 ComfyUI。在 2 张英伟达 GB200 上,生成 10 秒 720P 视频仅需 6.8 秒,API 版 23.7 秒输出 1080P。新模型具备更高像素保真度、多镜头连贯性及扩散保真渲染技术。用户可通过 Hugging Face、ComfyUI 及 API 调用。

Qwen 团队开源 Qwen3.8-2.4T-A95B 模型权重

Qwen团队开源模型,为Qwen-Max级别首次开放权重。该MoE模型总参数2.4T、每Token激活95B,原生支持256K上下文,重点提升编程、办公、科研及长周期Agent能力。在PaperBench、TerminalBench等多项评测中表现领先,支持SGLang、vLLM等框架部署,默认思考模式且支持推理深度调节。

8月12·周三
Manus 恢复独立公司运营

宣布脱离恢复独立运营。Manus去年12月被 Meta 用超20亿美元收购,因跨境监管审查,双方重新调整架构。Manus要求部分用户在8月23日前备份数据,8月25日恢复服务,受影响的用户过渡期间不被收取任何费用并提供回归奖励。

Bilibili 开源工业级零样本语音克隆模型 IndexTTS-2.5

Bilibili 开源工业级零样本语音克隆模型,参数量仅 0.8B,支持中、英、日、西、阿五种语言跨语种迁移。模型重构了推理架构,速度提升 2.28 倍,实时率低至 0.20,同时支持 0.5x 至 2.0x 无级语速调节,提供拼音、CMU 音素和日语假名三种粒度的发音干预。

豆包推出学生特惠活动

推出学生特惠活动,面向在校大学生提供2.5倍免费额度及专业版特惠价,辅助科研、创作等复杂学习任务。用户可通过豆包电脑端发送”我要领取学生优惠”完成认证,或在设置界面通过抖音账号认证获取权益。

微软推出编程模型 MAI-Code-1.1-Flash

微软推出升级版编程模型 ,代码能力显著提升:模型在 Terminal-Bench 2.1 测试中的表现提升 22%,.NET 任务提升 15%,并新增原生视觉能力。新模型 Token 生成速度提升 25%、消耗减少 25%,价格降至初代四分之一。目前已陆续登陆 VS Code、 等 Copilot 平台,旧版将于 2026 年 9 月 10 日全面停用。

8月11·周二
OpenAI 推出 AI 网络安全模型 GPT-5.6-Cyber

OpenAI扩展网络安全防御服务Daybreak,新增Blue与Red两个等级。Blue提供事件响应、恶意软件分析等常规服务;Red包含专为安全测试和漏洞研究训练的新模型。GPT-5.6-Cyber 模型目前仅向埃森哲、IBM、CrowdStrike等可信合作伙伴开放。

Meta 开源 300 亿参数大语言模型 Muse Glimmer

Meta 开源300亿参数模型。模型专为本地常驻运行设计,通过4-bit量化和DFlash投机解码技术,可在24GB显存设备,如Mac、消费级GPU上流畅运行,支持断网操作、多模态感知、工具调用及代码编写。

ZCode全面升级,GLM Coding Plan全员额度回满

智谱AI旗下 全面升级,上线 Goal、Subagents、Remote Control、闲时任务 四大功能。Goal模式支持设定可验收目标后自主拆解、执行并迭代交付复杂任务;Subagents实现多智能体并行协作;Remote Control支持手机/微信远程管控;闲时任务可在低峰时段免积分执行。同时,GLM Coding Plan 额度已统一重置,全员额度全部回满。

腾讯推出 Windows 端桌面美化工具「小鹅桌面」

腾讯推出Windows端桌面美化工具「」,以免费无广告为核心卖点切入市场,提供百万级4K超清动态与静态壁纸资源。产品在桌面左上角内置轻量化AI对话窗口,可完成待办备忘与文件搜索。工具面向学生及普通个人用户,与办公向产品形成错位布局,通过壁纸美化卡位Windows高频桌面场景。

8月10·周一
阿里推出一站式 AI 语音平台 CosyVoice Studio

阿里巴巴推出国内首个一站式AI语音平台,基于自研 Qwen-Audio 模型,集成语音记录 CosyFlow 、语音智能体 CosyAgent 和音频创作 CosyCreative 三大模块。CosyFlow支持语音转写叠加语义理解并生成结构化文本,CosyAgent可通过自然语言快速创建实时语音交互智能体,CosyCreative支持上传文档生成播客与多角色有声书。

英伟达开源自动驾驶 AI 推理模型 Alpamayo 2 Super

NVIDIA推出智能汽车开放模型,基于Cosmos 3 Super Reasoner构建并采用OpenMDW 1.1商业许可,支持商用与微调。模型在LingoQA等辅助驾驶基准测试中排名第一,可输出轨迹规划、因果推理、元动作、自动标注及视觉问答五类结果,决策过程透明可验证。

Cloudflare 推出 AI Agent 云端轻量浏览器 Kitesurf

Cloudflare 推出,专为 AI 智能体打造的云端浏览器,基于 Workers 平台运行,支持浏览网页与填写表单,较 Chromium 更省计算资源显著降低运行成本,同时针对 AI 特性优化上下文窗口与性能表现,防范提示词注入攻击,目前 Kitesurf 处于测试阶段,正式版将在未来推出。

腾讯混元团队推出 3D 世界生成框架 WorldClaw

腾讯混元3D研究团队推出 ,基于 Agent 的 3D 开放世界生成框架。框架能将一句开放式文本提示转化为可探索、可编辑的完整 3D 世界,在保持全局地形连贯性的同时,按需为局部区域生成丰富细节。WorldClaw 将地形与每个对象作为独立可编辑实例输出,支持自由视角漫游、对象级编辑及游戏引擎直接接入。

🤖
你好!我是本站的 AI 助手,有什么可以帮你的吗?