昨天刷到一条消息,小米把小爱同学的组织架构又调了。罗福莉带的MiMo团队接管基础模型能力,原来的负责人王刚去搞机器人了。说实话,这个调整挺有意思的。 为什么要调? 去年小米发MiMo的时候,圈内评价不错,7B参数跑出了不错的效果。但问题是,MiMo跟小爱同学怎么融合,一直没想清楚。现在把MiMo团队直接放到小爱上面,意思很明确——大模型要直接落地到产品里,不是发个论文就完事。 这意味着什么? 对开发者来说,有几点值得关注: MiMo API可能会开放更多能力——既然要落地到小爱,那底层接口大概率会更完善 端侧推理优…

2026年7月7日 0条评论 36点热度 0人点赞 veenyi 阅读全文

🚀 科技热点速递 以下是今日IT之家下午发布的科技新闻精选。 🤖 AI与科技 安全公司曝光黑客利用AI打造模块化恶意框架Avalon — 安全公司Blackpoint披露了一款名为Avalon的模块化恶意框架,该框架由黑客利用AI打造而成。与以往单一功能的恶意软件不同,Avalon可根据攻击需求灵活加载不同模块,大幅提升攻击灵活性。研究人员指出黑客利用该框架窃取设备凭证、破坏备份并加载勒索软件,反映出生成式AI已能帮助技术门槛较低的黑客快速构建复杂攻击工具。 来源 iPod之父法德尔:AI助手竞争核心在于设备生态 …

2026年7月7日 0条评论 38点热度 0人点赞 veenyi 阅读全文

科技热点速递 以下是今日IT之家发布的科技新闻精选。 🤖 AI与科技 苹果iOS 27 Beta 3增强Siri AI功能 — 苹果在最新Beta版本中激活了Siri的速度和表现力调整功能,用户可以通过滑块微调语音性能,每个控制项有5个调节级别。 马斯克xAI正式更名为SpaceXAI — SpaceX完成750亿美元IPO后,xAI更名为SpaceXAI。AI已成为SpaceX的主要投资方向。 谷歌Gemini 3.5 Pro泄露:支持200万Token上下文 — 即将发布的Gemini 3.5 Pro支持200…

2026年7月7日 0条评论 74点热度 0人点赞 veenyi 阅读全文

最近在GitHub上刷到一个项目叫 agent-skills,直接把我看愣了——这哥们把AI编程助手的"技能树"给整理出来了。以前用Claude Code或者Codex,总感觉它们像个只会执行命令的工具人。但装上这些skill之后,体验完全不一样了。 什么是AI Agent Skills? 简单说,就是给AI编程助手加"buff"。比如你让它review代码,它可能就给你列一堆issue。但装上code-review skill之后,它会自动扫描安全漏洞、检查代码风格、甚至帮你写单元测试。我实测了一下,一个300行…

2026年7月7日 0条评论 37点热度 0人点赞 veenyi 阅读全文

为什么需要自动化安全测试? 上个月公司要给内部系统做安全评估,我一个人翻了三天代码,结果第二天就发现有个SQL注入漏洞是上周刚改的。手动做安全测试真的太累了——漏洞库每天都在更新,攻击手法也越来越花哨,光靠人肉审计根本跟不上节奏。 正好GitHub上最近有个项目火了——T3MP3ST,一个多智能体的自动化红队平台。我花了两天时间搭起来跑了一遍,发现这东西确实有点东西。 T3MP3ST是什么? 简单说就是让多个AI Agent分工合作做渗透测试。一个Agent负责侦察,摸清楚目标系统的技术栈;一个负责漏洞扫描;还有一…

2026年7月7日 0条评论 46点热度 0人点赞 veenyi 阅读全文

🚀 科技热点速递 以下是今日IT之家下午发布的科技新闻精选。 🤖 AI与科技 谷歌升级 Google Cloud 机密计算产品 — 谷歌宣布对旗下 Google Cloud 机密计算产品进行重大升级,新增基于英伟达 Blackwell GPU 的机密虚拟机,采用 RTX PRO 6000 Blackwell Server Edition GPU 与 AMD EPYC Turin 处理器,结合 SEV 安全加密技术实现硬件级数据隔离。同时开源 Prompt Encryption SDK,为 AI 提示词提供端到端加密…

2026年7月6日 0条评论 58点热度 0人点赞 veenyi 阅读全文

为什么要在本地跑大模型? 上个月把家里吃灰的零刻SER5 Mini PC翻出来装了个Ubuntu,本来就想当个下载机用。结果GitHub上刷到jamesob/local-llm这个项目快1000星了,突然来了兴致——要不试试本地跑个大模型? 说白了就是不想每次都调API,贵不说,隐私数据总归不放心。本地跑的好处很明显:离线可用、零延迟、数据不出家门。 硬件配置和选型 我这台SER5是AMD Ryzen 5 5560U + 32GB内存,核显是Vega 7。内存是关键——7B模型至少要16GB,13B模型建议32GB…

2026年7月6日 0条评论 47点热度 0人点赞 veenyi 阅读全文

为什么要本地跑AI? 云端API虽然方便,但有三个绕不开的问题:数据隐私、网络依赖、持续成本。对于开发者来说,本地跑一个大模型,写代码时做个补全、处理文档时做个摘要,是非常实用的能力。 硬件要求 不同模型的硬件需求参考: 7B模型(如Llama 3.1 8B):8GB内存起步,有独显更好 13B模型:16GB内存 + 8GB显存 70B模型:64GB内存 + 24GB显存(或用量化版) 没有GPU也能跑,CPU推理虽然慢一些,但日常使用完全够用。 安装Ollama Ollama是最简单的大模型运行工具,一行命令安装…

2026年7月6日 0条评论 57点热度 0人点赞 veenyi 阅读全文

今日IT之家科技新闻精选:摩尔线程完成美团LongCat-2.0适配、吉利银河TT内饰公开、英特尔确认CPU涨价、索尼宣布2028年停售实体光盘、谷歌高管用AI移植经典游戏等。

2026年7月6日 0条评论 133点热度 0人点赞 veenyi 阅读全文

什么是投机解码? 跑大模型的时候,你肯定遇到过这种情况:一个7B的模型在消费级显卡上生成速度慢得让人抓狂。DeepSeek最近开源的DeepSpec项目,用投机解码(Speculative Decoding)技术把推理速度提升了2-3倍,而且完全不影响输出质量。 投机解码的核心思路 传统自回归推理是逐token生成的,每个token都要过一遍完整模型。投机解码的做法是:用一个小的"草稿模型"快速生成多个候选token,然后用大模型一次性验证这些候选。如果草稿猜对了,直接跳过;猜错了才回退重来。 关键在于:验证比生成…

2026年7月6日 0条评论 44点热度 0人点赞 veenyi 阅读全文