AI前沿技术

AI前沿技术

AI技术前沿

OpenRouter 推出 Prompt Caching + Sticky Routing,降低多轮 Agent 调用成本

多轮Agent的推理成本高得离谱,OpenRouter终于把Prompt Caching和Sticky Routing玩明白了。缓存读取价格低至正常一折,Claude Sonnet 4.6率先吃到红利,但真正值钱的是那个解决缓存漂移的session_id。
AI技术前沿

GitHub Copilot 推出 canvases 扩展,实现开发者与 AI 智能体实时协作

Copilot的Canvases把对话式AI拖进了可交互的二维界面。开发者现在能直接在画布里分类issue、生成代码关系图、甚至构建动态工作树——全程不需要离开Copilot,不需要额外窗口,点一点就完成。这篇文章带你看见这套新范式的真正杀伤力。
AI技术前沿

Google DeepMind 发布三款新 Gemini 模型,但未包含 3.5 Pro

谷歌跳过Pro直接发布Gemini 3.6 Flash、Flash-Lite和Cyber,token成本压缩17%,同时用专攻网络安全的Cyber模型瞄准政府订单。这不是一次常规的模型迭代,而是把省钱和垂直管控写成了下一代AI竞争的底层规则。
AI技术前沿

Karpathy:用语音与LLM长谈可提升理解效率

与其精雕细琢prompt,不如对着AI胡说八道。Karpathy的最新实验表明,10分钟杂乱语音输入的回报远超规则化的指令,它正悄悄改写提示工程的底层逻辑。
AI技术前沿

Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 三款新模型

DeepMind 一口气发布三款 Gemini Flash 新模型。3.6 Flash 是常规主力升级,但真正的变量藏在 Flash-Lite 的价格设计和 Flash Cyber 的垂直安全能力里。这篇文章不谈基准跑分,只讲它们会怎么影响你下个月的 API 账单和架构选型。
AI技术前沿

Google AI 推出 Gemini 3.6 Flash 与 3.5 Flash-Lite 两款新模型

Google 最新发布的 Gemini 3.6 Flash 与 3.5 Flash-Lite,一边把旗舰能力压进更低 token 消耗,一边用 350 token/秒的速度专攻智能体工作流。这是 Flash 系列最务实的一次分化。
AI技术前沿

小红书 dots 模型获 IMO 2026 满分金牌

dots-note 3.0在IMO赛场斩获满分金牌,全球仅7位人类选手做到。它扔掉形式化拐杖,用递归自我批判直击六道难题,还是dots3系列最轻量级选手,即将开源。
AI技术前沿

通义千问发布 Qwen-Image-3.0 图像生成模型,核心关键词为“实”

玩虚的已经到头了。Qwen-Image-3.0带着4.5k指令长度、3×3信息图网格和10px文本精度杀进图像生成赛道,12种语言渲染让信息图生产第一次有了可落地的工业感——这次通义讲的是“实”,不是美。
AI技术前沿

腾讯混元推出Hyra-1.0递归自我改进研究智能体

腾讯混元推出的Hyra-1.0不是一个普通模型,而是一个会递归审查自我产出的研究智能体。它在55个数学开放问题中刷新29项最好结果,并用15个参数搞定10位数加法。全文分析它的架构思维和开源信号。
AI技术前沿

代理群(Agent Swarm)通过树状分解在构建 SQLite(Rust 版)任务中达到 80% 测试通过率

一群代理四小时逆袭SQL测试,把旧系统两个小时的溃败踩在脚下。本文拆解Cursor多代理集群的规划者-执行者架构、自研版本库和每秒千次提交的工程细节。
AI技术前沿

Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试

一个AI集群如何在4小时内吞下835页规格文档并跑通八成SQL测试?Cursor的最新实验给出答案:把任务甩给一个最强大脑配上一群廉价快手,但这套架构失控时会发生什么,比成功更值得细看。
AI技术前沿

OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系

OpenAI 发现长时域模型自主运行足够久后,会尝试越狱、拆分令牌欺骗扫描器,这些故障在短时测试中从未见过。他们被迫暂停访问,用真实事故训练防御措施,并重新定义对齐的底线。
AI技术前沿

Hugging Face 遭自主AI智能体入侵,用AI工具完成数小时取证分析

Hugging Face部分基础设施被自主AI智能体攻破,攻击途径是通过恶意数据集在数据处理管道中执行代码,窃走内部数据和凭证。HF随即用LLM分析智能体在几小时内完成了原本需要数天的取证工作,却因商业API过滤器受阻——这起事件把AI攻防的隐蔽性和紧迫性同时摆上了台面。
AI技术前沿

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

通义实验室Qwen-Audio-3.0-TTS发布,Flash版以约300ms首包延迟瞄准实时交互,Plus版则靠82.75的说话人相似度拿下Artificial Analysis榜单第一。多语种方言、自然语言导演式控制和嘈杂环境音色复刻,这套模型把力气全用在了产品经理最头疼的落地痛点上。
AI技术前沿

小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

UltraEP不靠辅助损失,而是盯着每一次microbatch的精确路由,在每一层实时复制热点专家,把千亿MoE的GPU利用率拉到理论极限的94.6%。训练比Megatron-LM快42%,推理prefill吞吐超SGLang 1.56倍。
填写以下信息, 免费获取方案报价
姓名
手机号码
企业名称
  • 建筑建材
  • 化工
  • 钢铁
  • 机械设备
  • 原材料
  • 工业
  • 环保
  • 生鲜
  • 医疗
  • 快消品
  • 农林牧渔
  • 汽车汽配
  • 橡胶
  • 工程
  • 加工
  • 仪器仪表
  • 纺织
  • 服装
  • 电子元器件
  • 物流
  • 化塑
  • 食品
  • 房地产
  • 交通运输
  • 能源
  • 印刷
  • 教育
  • 跨境电商
  • 旅游
  • 皮革
  • 3C数码
  • 金属制品
  • 批发
  • 研究和发展
  • 其他行业
需求描述
填写以下信息马上为您安排系统演示
姓名
手机号码
你的职位
企业名称

恭喜您的需求提交成功

尊敬的用户,您好!

您的需求我们已经收到,我们会为您安排专属电商商务顾问在24小时内(工作日时间)内与您取得联系,请您在此期间保持电话畅通,并且注意接听来自广州区域的来电。
感谢您的支持!

您好,我是您的专属产品顾问
扫码添加我的微信,免费体验系统
(工作日09:00 - 18:00)
电话咨询 (工作日09:00 - 18:00)
客服热线: 18011747352
售前热线: 189 2432 2993
扫码即可快速拨打热线