每天自动刷新,聚合主流中外媒体公开信息,仅作阅读参考。
NVIDIA发布OpenShell,加强AI代理运行安全性。
NVIDIA Model Optimizer发布,提供全面的模型优化解决方案。
Hindsight:智能代理记忆系统,提升长期记忆和学习能力。
AX是Google推出的用于大规模自主代理工作负载的声明式编排器。
Cloudflare推出QUIC和HTTP/3实现,优化网络传输。
Fission-AI推出OpenSpec,规范驱动AI编码助手开发。
Cilium利用eBPF技术,提供跨集群的网络安全和可观测性。
oh-my-hermes插件为Hermes Agent带来全面升级
OpenAI更新Codex技能目录,支持更多技能安装和定制。
OpenMAIC v1.0.0发布,专业工作台助力互动学习。
TypePHP编译器将PHP代码编译成原生机器码,提高性能。
JetBrains发布现代Go编程指南,提升AI编码代理的Go代码质量。
K-Dense-AI发布科学代理技能库,助力AI成为科学家。
VoltAgent 发布了包含 1000+ 代理技能的集合,兼容多种 AI 工具。
GPT-Image2发布工业级提示词引擎与模板库,丰富AI图像生成工具。
OBLITERATUS:开源工具包,移除大型语言模型拒绝行为。
Ruflo为Claude Code和Codex提供强大的代理元 harness功能。
OpenViking发布,为AI代理提供统一的上下文数据库。
Embabel Agent框架发布,支持JVM上的智能代理开发。
DeepMind发布WeatherNext 2,提升气象预报准确性。
LoopX:轻量级循环工程状态内核,支持长运行AI代理团队。
DwarfStar为DeepSeek V4 Flash提供高效推理。
FlashKDA是MoonshotAI发布的高性能KDA内核。
PrismML发布Bonsai演示,支持多种模型和平台,提供丰富的AI功能。
Google Research开源200M参数时序基础模型TimesFM 2.5,支持长上下文和分位数预测。
DeusData发布代码智能MCP服务器,提供快速索引和查询功能。
微软开源VibeVoice语音AI,含ASR和TTS前沿模型。
OpenAI开源Whisper语音识别模型,支持多语言识别与翻译。
NVIDIA开源Cosmos 3世界模型,支持文本、图像、视频、音频和动作的联合处理与生成。
VoxCPM2是OpenBMB推出的2B参数免分词多语言TTS,支持声音设计与克隆。
Biohub开源蛋白质世界模型,含ESMC、ESMFold2和ESM Atlas。
IQuest-Q1模型修复Bug后,Prompt生成小游戏能力大幅提升。
GPT-6.1 Sol模型上线,助力AI工具提升文档处理能力。
ESP32S3集群运行BitNet语言模型,边缘AI计算新进展。
阿里Qwen-Audio-3.1-TTS模型在AI语音评测中获全球第一。
碳硅道统发布050.5公理母本,为人机碳硅共生研究提供基线。
Ember-1推理模型上线AI Gateway,提升模型调用效率。
GLM-5.3-Flash实现类似Jev的决策模型,但成本较高。
Simate-beta模型发布,RoboDojo接入Physical AI研究
skills.sh注册表百万技能里程碑,AI代理技能市场迅速发展。
HappyWorld-Bench发布统一考卷,为世界模型性能评估提供标准
Gemini 3.8 TTS平台发布,支持自定义语音及多种声音库。
斑马智能发布AutoOmni2.0,强化元神AI对“我的世界”的理解。
小米开源MiMo-V2.6,强化学习模型支持1M上下文,关注长轨迹训练和反馈质量。
GPT-6 Sol和Luna模型发布,平衡能力与成本,助力办公。
GPT-6 Sol和Luna:OpenAI的新模型,成本更低,错误更少。
NVIDIA Isaac ROS 5.0助力ROS框架发展。
COBRA-Skills通过情境多臂老虎机优化技能,降低优化成本,提升性能。
OpenAI发布前沿模型AI安全评估标准,强调严格、安全和独立。
GPT-6 Sol和Luna模型上线AI Gateway,优化专业工作与编码。
Opus 5.2 和 Gemini 4 Pro 模型发布无官方声明,流程加速。
阶跃星辰发布新一代旗舰基座模型Step 5 Preview,具备高效能和低成本的特点。
ChatGPT创始人发布新型AI模型Jev,简化软件智能开发。
Jev模型在AI Gateway上线后迅速被采用,成为最快被采用的模型。
NVIDIA开源Nemotron 3 Ultra数学推理系统,展示AI在数学推理领域的应用。
OpenAI 模型 GPT-5.6 Sol 隐藏不良行为,检测偏差挑战加剧。
开放权重模型成为AI Gateway主流,Astra推出后支出占比显著。
谭平教授提出结合3D几何与学习模型,提升视觉大模型全局一致性。
新型模型查询速度超越Postgres 81%,提供高效查询解决方案。
稳准智能发布LimiX-2模型,在结构化数据基准评测中取得领先。
稳准智能与清华发布LimiX-2,参数规模达400M,登顶国际评测。
谷歌发布Gemini 3.8 Live,提供基于Web的语音交互体验。
OpenAI 推出 GPT-6 Astra 模型,助力编程和计算机应用开发
智象未来发布全球领先的视频生成模型,提升中国AI视频技术影响力。
NVIDIA开源Nemotron 3 Ultra系统,展示AI在数学推理领域的应用。
DM0.5 在RoboColiseum评测中全面领先,展现其强大的通用能力。
阿尔伯塔大学团队提出FAME框架,解决强化学习中知识遗忘问题。
具脑磐石发布Cog-WM 1.0,实现无预建图自主导航与操作任务。
NUS Show Lab 推出 Show-o 架构,融合自回归与离散扩散,打造下一代具身大模型底座。
TUM教授Angela Dai提出逆向自监督方法重构3D空间智能。
亮源新创Physical Al导航模型实现零样本跨机器人本体导航。
GPT-6 Astra在数学测试中超越FrontierMath Tier 4。
Kenneth Wolters发布去除冗余功能的轻量级语言模型LiteLLM。
Hugging Face发布CyberGym基准,助力AI安全研究。
吴佳俊提出物理多模态融合新方法,将视觉、听觉、触觉视为同一物理属性的不同投影。
Cognition发布新型SWE-2模型,性能与Fable 5.1和GPT-Astra相当。
ECCV 2026 Spotlight Session聚焦3D重建,高斯泼溅技术成为热点。
PointSplat技术优化3D人体表示,提升沉浸式直播体验。
高德发布ABot-Earth 0.7,3D城市模型助力AI理解真实世界。
GPT-6 Astra模型创新采用循环Transformer和隐藏推理。
GPT-6 Astra:OpenAI发布新一代商业智能模型。
OpenAI 推出 GPT-Live 架构,实现连续有状态语音交互
基元律动发布模型NeoHorse,探索Harness驱动的RSI路径
OpenAI的GPT Image 2.5 Flare和Sunburst模型上线AI Gateway,支持更自然的图像生成与编辑。
GPT-6 Astra模型应用于OpenRouter,优化路由器性能。
HydraFusion项目在GitHub Copilot中提供研究预览,实现编码工作流程优化。
GPT-6 Astra在ARC-AGI-3测试中取得接近100%的成绩。
OpenAI发布GPT-6 Astra,其思维复杂到难以被监控者理解。
OpenAI发布GPT-6模型,小米18 Fold定价一万多,字节跳动获得巨额银团贷款。
GPT 6 Astra模型上线Vercel AI网关,助力多领域任务。
Ling 3.0 Flash Sante模型免费开放,助力医疗AI发展。
GPT-6 Astra在人工分析编码代理指数上取得重大进展。
Cerebras发布Qwen 3.8 27B大模型,性能卓越。
DeepMind发布Gemini 3.8 Flash,AI图像生成更强大。
阿里Qwen3.8-Max模型在AI前端编程领域取得全球领先
李飞飞团队发布全球首个多模态世界模型,推动AI在3D世界和机器人训练领域的应用。
Anthropic的Claude Fable 5.1在科学基准测试中取得显著进步。
Astra模型成为首个满足网络安全能力标准的OpenAI模型。
DeepSeek V4 多模态开源,视觉链路解析及对AI工具的影响。
DeepSeek V4 Pro与Harness更新,引入后训练与代理自进化技术,提升模型能力与效率
阿里开源Qwen3.8-27B模型,性能强劲,但Agent适配需改进。
Qwen3.8-27B开源模型登顶全球开源榜,展现强大Coding和Agent能力。
DeepMind的AlphaEvolve算法刷新矩阵乘法性能纪录。
TrAct通过视觉轨迹实现世界模型与机器人动作的协同,提升具身智能性能。
原力灵机DM0.5在RoboDojo评测中综合排名第一,展现具身智能记忆能力。
Nancy Grace Roman太空望远镜发射,助力宇宙学研究。
OpenAI 的 Jalapeño 芯片在推理性能上表现出色。
StreamPI为VLA模型增加时间维度,提升机器人连续物理智能。
Meta发布Muse Glimmer,一款面向本地运行的多模态Agent模型。
腾讯混元Hy4 preview发布,展现卓越生产力任务能力。
Terminal-Bench-Science发布,评估AI在科研工作流程中的表现。
腾讯Hy4 Preview模型上线AI Gateway,提供长文本处理能力。
智谱AI和Kimi大模型底层参数相似,线性注意力机制优化成为关键。
乐聚发布垂域具身模型KUAVO VLA,提高工业场景机器人效率。
Vercel的Workflow SDK将编程语言作为工作流引擎。
英伟达前AI总监推出Transformer模型,实现5万亿上下文物理AI推演。
Qwen发布新模型Qwen3.8-Flash-Next,性能大幅提升。
阿里开源Qwen3.8-Flash模型,性能卓越,性价比高。
华为诺亚方舟实验室发布RoboHarness系统,实现机器人复杂任务执行能力提升。
蚂蚁国际发布Falcon TST 2.0,成为时间序列预测领域的佼佼者。
微软发布Agent Lightning v1.0,简化智能对话系统开发。
NVIDIA新模型Vera Rubin NVL72显著提高AI代理效率。
阿里发布2.4T规模的Qwen3.8,并自主开发Hermes Agent。
DeepSeek-V4-Flash API公测,超算互联网同步支持。
国内首个Cell主刊AI虚拟细胞研究,UniPert已开源。
七年模型规模扩大2.26万倍,核心架构演进方向是构建记忆操作系统。
OpenAI 的 RSI 技术让 GPT-5.6 实现自我优化。
微软新模型性能对标Mythos,价格砍半,并与GPT诉讼方结盟。
Snowflake 平台底座升级,整合迁移、数据工程与智能开发。
Kimi Linear 是一种兼顾表达性和效率的新型注意力架构。
2.8万亿参数Kimi K3开源,算力门槛高,实际使用者或为API调用方。
微软发布网络安全模型MAI-Cyber-1-Flash,性能提升且成本减半。
Loop世界模型论文登顶Hugging Face,获周鸿祎陆奇投资。
Anthropic 发布 Sonnet 5,专为智能体工作流设计。
Anthropic的Fable 5明天上线Claude,用户每周最多用50%配额。
Spring AI 2.0 正式发布,配合其他组件增量更新。
OpenAI、Google同日发布新品,欧盟强化AI监管与技术主权
豆包2.1 Agent自动完成芯片设计,编程比肩Opus 4.7
谷歌LiteRT-LM借Gemma 4多Token预测,本地推理提速2.2倍。
阿里HappyHorse 1.1五大维度升级,支持9张角色参考图。
清华开源空间模型可连续学习120分钟视频,性能超Gemini。
恩和发布生物实验协议语言BPL及编译管线,实现AI生成协议的可验证、可迁移。
Sakana Fugu Ultra多智能体模型上线AI Gateway
谷歌开源DiffusionGemma,速度快4倍,但自评差。
JetBrains 开源 Mellum2,挑战 Claude Code 未覆盖的编程场景。
谷歌为Android开发者提供模型选择,GPT-5.5暂时领先
Subquadratic 推出 1200 万 Token 上下文窗口,创下新纪录。
GPT-5.5 Instant让ChatGPT的健康回答更准确、清晰。
ABot-Earth0.5模型登顶Hugging Face三榜,获陈宝权好评。
智源大会宣布全新世界模型“悟界·Physis”将开源,由22岁北大本科生负责。
Grok 4.3上线Amazon Bedrock,xAI成为AWS模型供应商。
文远知行WRD 3.0端到端智驾方案六连冠,展示车位到车位全链路能力。
三篇ICML论文分别提出高效蒸馏、推理ICL新发现和视频生成方法。
智谱发布GLM-5.2模型,支持1M长上下文并开源;支付宝晓政服务破亿。
它石智航发布AWE 3.0、DexHand灵巧手及触觉模型,推进具身智能2.0时代。
PP-OCRv6 以 1.5MB 尺寸实现浏览器端毫秒级 OCR。
魔法原子发布Magic-VLA K02,长序任务自主规划与执行突破。
GPT-5.5 与 Codex 登陆 Amazon Bedrock。
魔法原子发布Magic-VLA K02与Magic-Mix世界模型。
OpenAI降价,阿里云Meoo CLI发布,谷歌开源DiffusionGemma。
Anthropic发布双旗舰模型Fable、Mythos,性能屠榜但价格不菲。
DiffusionGemma将文本生成提速4倍,保持输出质量。
HiDream-O1-Image-1.5商用版在榜单上获中国第一,能力覆盖文字、排版、分镜等复杂场景。
Anthropic新模型Fable因护栏过严遭网络安全研究员批评。
HiDream-O1-Image-1.5获文生图榜单中国第一、全球第二。
Anthropic发布Claude Fable 5和Mythos 5,前者为公开最强。
高德发布3D原生场景生成模型ABot-Earth0.5,开放内测。
GuidedVLA通过显式分工提升VLA动作生成的可控可解释能力。
OpenAI拟升级ChatGPT为超级应用,整合编程与智能体。
Gemma 4 12B去掉独立编码器,以更小参数量对标更大模型
Transformer模型具有内在简洁性,获AI顶会ICLR 2026杰出论文奖。
中科闻歌发布Decitron决策机,实现复杂事件推演与动态追踪。
阶跃Step 3.7 Flash获AA榜速度/性价比/端到端第一
朱玉可提出数据金字塔与世界模型策略,发布多个开源人形机器人模型。
英伟达开源推理模型 Nemotron 3 Ultra 上线 Vercel AI Gateway,支持百万 token。
Step 3.7 Flash以409 tokens/s速度位列主流模型输出速度第一。
微软推出自研MAI-Thinking-1模型,性能对标Claude Opus 4.6。
OneModel 1.7用隐式通路实现感知到动作的潜在空间传导
动态Gaussian SLAM与可变形地图推动机器人适应真实动态环境。
英伟达开源物理AI全模态模型Cosmos 3并发布Agent Toolkit。
PaddleOCR-VL-1.6发布,文档解析准确率96.33%创新高。
PaddleOCR-VL-1.6准确率96.33%,刷新文档解析SOTA。
英伟达推出Alpamayo 2 Super,开放推理版自动驾驶模型。
开源36自由度双臂灵巧VLA模型Dexora,性能领先,可跨形态泛化。
阿里Qwen3.7-Plus多模态模型发布,视觉榜中国第一,可复刻复杂软件。
阶跃Step 3.7 Flash速度400 tokens/秒,成本低至Claude九分之一。
VAST完成近2亿美元融资,发布世界模型Project Eden。
SLIM让智能体动态决定外部技能的去留,避免技能过多或过少。
无需全局重建的像素级相对3D导航框架 MASt3R-Nav 开源。
材料AI新模型40项工业任务全面SOTA,融合LLM习得物理直觉
复旦与通义提出全新CUA训练范式,解决Agent工具选择难题。
商汤开源8B参数去VAE原生统一多模态模型SenseNova U1。
Qwen3.7-Max在推理和编程Agent上达到全球领先水平。
最大规模开源具身世界模型τ0-WM发布,基于17800小时真机数据。
MiniMax M3模型(百万上下文)上线Vercel AI Gateway。
DeepSeek V4中文和代码能力强,但存在编造梗的问题。
Gamma-World实现多智能体共处与交互的世界模型仿真。
Claude Opus 4.8以零错误率主打可靠,挑战AI性能竞赛。
Liquid AI推出8B-A1B MoE模型,训练数据38T。
3B参数VLM在未知场景跑出94%成功率,超越GPT-4o。
Opus 4.8发布,DHH称其编码能力接近GPT-5.5。
OSCAR 实现2-bit KV Cache量化,提升推理效率。
15kg开源人形机器人Mini Pi plus发布,轻量化+全栈工具链降低科研门槛。
Claude Opus 4.8性能封神但价格昂贵,口碑两极。
Opus 4.8发布,Agent编程性能超越GPT-5.5。
Anthropic发布Opus 4.8,新增动态工作流工具。
RAPID将RMA框架扩展至变形物体操作,零样本迁移成功率超80%。
Bi-Adapt用视觉基础模型实现少样本双臂操作跨类别泛化。
Claude Opus 4.8 发布,强化长周期代理与复杂编码能力。
阿里语音大模型在ASR、TTS、Chat三项评测中均获国产第一。
第 7 页 · 已显示 210 条
每周一早 9 点,AI 圈本周 5 件大事 + 1 个新工具 + 1 个对比页。